NVIDIA Nemotron
Modelos abertos, multimodais e de alta eficiência para agentes de IA de longa execução.
Visão geral e benefícios
Modelos abertos criados para cargas de raciocínio
O NVIDIA Nemotron é uma família aberta de modelos de raciocínio, otimizados para precisão e eficiência computacional em cada etapa de um fluxo de trabalho agêntico — além de recursos multimodais para visão, fala, recuperação e segurança.
Nemotron Nano
Precisão e eficiência superiores para subagentes especializados que rodam de forma econômica na borda ou em escala.
Nemotron Super
A mais alta precisão, raciocínio de alta taxa de transferência e chamada de ferramentas para sistemas multiagentes em produção.
Nemotron Ultra
Raciocínio de primeira linha para fluxos de trabalho críticos de várias etapas que exigem planejamento profundo.
Compreensão visual
Raciocine sobre vídeo, áudio, imagem e texto para impulsionar agentes multimodais e a compreensão de documentos.
Fala
ASR, TTS e tradução automática neural de latência ultrabaixa para experiências de voz em tempo real.
Geração aumentada por recuperação
O Nemotron Retriever oferece embeddings e reordenação de alta precisão para fundamentar as respostas nos seus dados.
Segurança
Segurança de conteúdo em tempo real, proteção contra jailbreak e barreiras multilíngues para implantações confiáveis.
Modelos
Escolha o modelo Nemotron certo
Todos os modelos Nemotron estão disponíveis para download e implantação a partir do build.nvidia.com — escolha o nível que corresponde às suas metas de precisão, latência e custo.
Nemotron Nano
Raciocínio compacto e eficiente para subagentes, implantações na borda e pipelines de alto volume.
Ver no build.nvidia.comNemotron Super
Equilíbrio entre precisão e taxa de transferência, com uma forte chamada de ferramentas para sistemas multiagentes em produção.
Ver no build.nvidia.comNemotron Ultra
Profundidade máxima de raciocínio para fluxos de trabalho complexos, críticos e de várias etapas.
Ver no build.nvidia.comTecnologia
Blocos de construção para a IA agêntica
Combine os modelos Nemotron com a pilha de software da NVIDIA para criar, otimizar e implantar agentes de IA em produção.
NVIDIA NeMo
Uma plataforma de ponta a ponta para criar, personalizar e implantar modelos de IA generativa com seus próprios dados.
Saiba maisNVIDIA NIM
Microsserviços de inferência otimizados para a implantação rápida e segura dos modelos Nemotron em qualquer lugar.
Saiba maisNVIDIA Blueprints
Fluxos de trabalho de referência que mostram como montar os modelos Nemotron em aplicações agênticas reais.
Saiba maisComeçar
Formas de começar
Comece a prototipar gratuitamente
Explore e teste os modelos Nemotron instantaneamente no seu navegador com o catálogo de APIs da NVIDIA.
Começar a prototiparExecutar em provedores de inferência
Implante o Nemotron nos principais provedores de inferência e na sua própria infraestrutura.
Ver provedoresEntre em contato
Fale com a equipe da NVIDIA sobre a implantação do Nemotron em escala empresarial.
Falar com vendasEmpresas adotantes
Empresas que usam o Nemotron
Organizações líderes criam agentes de IA e copilotos em produção com o NVIDIA Nemotron.
Perguntas frequentes
Perguntas frequentes
Os modelos NVIDIA Nemotron são verdadeiramente de código aberto. A NVIDIA publica os conjuntos de dados de treinamento, as técnicas usadas para criá-los e os pesos dos modelos para que a comunidade possa compreendê-los e reproduzi-los totalmente.
Pronto para começar?
Crie, personalize e implante modelos abertos NVIDIA Nemotron para o seu próximo agente de IA.
Experimente o Nemotron ao vivo no chat acima — sem necessidade de cadastro.