> For the complete documentation index, see [llms.txt](https://docs.adapta.org/llms.txt). Markdown versions of documentation pages are available by appending `.md` to page URLs; this page is available as [Markdown](https://docs.adapta.org/modelos-de-texto/nemotron-super.md).

# Nemotron Super

O **Nemotron Super** é a versão focada em altíssima performance estrutural, throughput acelerado e processamento inteligente de longos contextos do ecossistema NVIDIA dentro da plataforma. Desenvolvido sobre uma arquitetura híbrida revolucionária, ele foi projetado para entregar respostas ultra-rápidas e lidar com fluxos massivos de dados, sendo perfeito para tarefas industriais, automações complexas e análise de grandes volumes de informação.

### O Que é o Nemotron Super?

Este modelo é uma inteligência artificial de última geração que combina a eficiência da arquitetura Mamba com a precisão dos modelos Transformer, operando sob o sistema de Mistura de Especialistas (MoE). Com 120 bilhões de parâmetros totais e 12 bilhões de parâmetros ativos por token, o Nemotron Super garante que tarefas de escala corporativa sejam processadas com eficiência computacional máxima e sem gargalos de processamento.

### Características Principais

* **Arquitetura MoE Expandida:** Conta com quatro vezes mais especialistas ativados de forma inteligente, entregando uma capacidade de raciocínio profundamente refinada sem aumentar o custo de inferência ou o consumo de recursos.
* **Velocidade e Vazão Extremas:** Entrega um *throughput* impressionante de 191 tokens por segundo, garantindo respostas e interações praticamente instantâneas mesmo para prompts massivos.
* **Janela de Contexto Ampla:** Possui uma memória de trabalho robusta de 256K tokens, permitindo a ingestão e o cruzamento de livros inteiros, códigos complexos e extensas bases de dados de uma só vez.
* **Eficiência Híbrida:** A fusão entre Mamba e Transformer une o melhor dos dois mundos: o processamento linear ultra-veloz de sequências longas e a atenção impecável aos detalhes textuais.

### Como Funciona

O Nemotron Super processa as solicitações roteando cada parte do prompt para os especialistas mais adequados dentro de sua rede de 120B de parâmetros. Ao utilizar uma infraestrutura focada em latência reduzida, o modelo consegue ler contextos gigantescos em tempo recorde e disparar a escrita da resposta a uma velocidade de 191 tokens/s, mantendo a coerência absoluta do início ao fim.

### Casos de Uso

* **Análise de Dados em Larga Escala:** Ideal para auditar e cruzar informações escondidas em relatórios com milhares de páginas ou logs de sistema contínuos.
* **Automações Industriais e Scripts:** Perfeito para rodar como o motor de fluxos de trabalho automatizados que exigem decisões em frações de segundo baseadas em múltiplos critérios.
* **Processamento de Contextos Massivos:** Excelente para equipes que precisam analisar documentações técnicas completas, contratos extensos e históricos de projetos sem fragmentar o arquivo.
* **Aplicações de Alta Frequência:** Uso em ambientes que demandam interações contínuas e geração de conteúdo em lote onde o tempo de resposta é um fator crítico.

### Exemplos Práticos de Uso

* **Tecnologia:** Um arquiteto de soluções envia uma documentação de infraestrutura de 200 páginas e o modelo mapeia todas as dependências do sistema de forma quase instantânea.
* **Operações:** Uma empresa utiliza o modelo para analisar e resumir dezenas de e-mails e relatórios de performance operacional recebidos ao longo do dia em um único bloco veloz.
* **Jurídico:** Um auditor anexa múltiplos processos e contratos de auditoria extensos e o Nemotron Super localiza cláusulas conflitantes em segundos devido ao seu alto *throughput*.
* **Produtividade:** Um gestor de projetos solicita a consolidação de um histórico de chat de meses de trabalho, gerando um plano de ação estruturado sem perder nenhum detalhe do início da conversa.

### Conclusão

O Nemotron Super é a ferramenta de produtividade definitiva para quem exige o topo do desempenho computacional e não pode esperar por respostas demoradas. Impulsionado pela engenharia da NVIDIA, ele garante que volumes massivos de dados trabalhem na velocidade máxima que o seu negócio exige, eliminando qualquer barreira de tempo e escala.


---

# Agent Instructions
This documentation is published with GitBook. GitBook is the documentation platform designed so that both humans and AI agents can read, navigate, and reason over technical content effectively. Learn more at gitbook.com.

## Querying This Documentation
If you need additional information that is not directly available in this page, you can query the documentation dynamically by asking a question.

Perform an HTTP GET request on the current page URL with the `ask` query parameter, and the optional `goal` query parameter:

```
GET https://docs.adapta.org/modelos-de-texto/nemotron-super.md?ask=<question>&goal=<endgoal>
```

`ask` is the immediate question: it should be specific, self-contained, and written in natural language.
`goal` is optional and describes the broader end goal you are ultimately trying to accomplish on behalf of the user. GitBook uses it to tailor the answer towards what is most useful for that goal.

The response will contain a direct answer to the question and relevant excerpts and sources from the documentation.

Use this mechanism when the answer is not explicitly present in the current page, you need clarification or additional context, or you want to retrieve related documentation sections.
