NVIDIA Nemotron
Família aberta de modelos da NVIDIA com pesos, dados de treino e guias de treinamento para agentes de IA especializados, além de uma API de protótipo via NVIDIA NIM.
Categoria: Desenvolvimento e Código · Frameworks de agentes e RAG
Funções
NVIDIA Nemotron não é um app de chat com plano mensal. É uma família aberta de modelos para agentes, com API de protótipo e auto-hospedagem.
- Pesos, dados de treino e guias de treinamento abertos; a página do tema indica o download no Hugging Face
- Nemotron 3: MoE híbrido Mamba-Transformer, contexto de até 1 milhão de tokens segundo a NVIDIA
- Nemotron 3.5 Lightning: MoE aberto de 30B com 3B de parâmetros ativos para agentes sempre ativos
- Também cita Ultra 550B A55B, Super 120B A12B, Nano 30B A3B e Nano Omni 30B A3B, além de Retriever, Parse, Speech e Safety
- API de protótipo sem cartão de crédito; URL base https://integrate.api.nvidia.com/v1, OpenAI Chat Completions
- Execução com vLLM, SGLang, Ollama, llama.cpp e NVIDIA NIM
Preços e planos
| Plano | Preço | Período | O que está incluído |
|---|---|---|---|
| API de protótipo | grátis | acesso de teste grátis, sem preço por token | FAQ, literal: 'All models offer a free trial tier with no credit card required.' URL base https://integrate.api.nvidia.com/v1, autenticação com uma chave de API da NVIDIA Os mesmos endpoints implementam a API OpenAI Chat Completions Modelo de exemplo na página do Ultra: nvidia/nemotron-3-ultra-550b-a55b |
| Produção | sob consulta | endpoint de parceiro ou NIM auto-hospedado | Página do Ultra: protótipo no endpoint de API grátis e escala por endpoints de parceiros ou implantação auto-hospedada A página do tema não publica um preço único da NVIDIA por token para a família Os preços de cada parceiro são desse fornecedor, não um preço de lista da NVIDIA |
Limites
Os modelos podem ser auto-hospedados. O protótipo hospedado roda em build.nvidia.com. A página do tema indica até 1 milhão de tokens de contexto para a família Nemotron 3; é um número da família, não uma janela de contexto verificada para cada modelo individual. Não há ali um preço de lista único da NVIDIA por token para produção. A produção usa os endpoints de parceiros citados ou um NIM auto-hospedado. A página não informa se os prompts da API de protótipo são usados para treinamento.
Alternativas e ferramentas semelhantes a NVIDIA Nemotron
FAQ
O NVIDIA Nemotron tem uma opção gratuita?
Não de forma permanente. O que consta é um teste gratuito por tempo limitado.
Onde fica a sede do fornecedor do NVIDIA Nemotron?
NVIDIA Corporation tem sua sede nos EUA. Independentemente da sede, o tratamento de dados e a privacidade seguem o contrato do fornecedor.
Quantos planos estão documentados para NVIDIA Nemotron?
O catálogo documenta 2 planos com preço, período de cobrança e recursos incluídos.
O NVIDIA Nemotron ainda está ativo?
O NVIDIA Nemotron ainda está ativo: Família aberta de modelos com API de protótipo em build.nvidia.com e pesos para download. Não é um chat de consumo com plano mensal.
Quantas fontes oficiais estão registradas para o NVIDIA Nemotron?
Para o NVIDIA Nemotron há 4 fontes oficiais registradas, nas quais preços e limites se baseiam.
Como comparamos
Comparamos acesso grátis, entrada paga, limites do plano, funções e as fontes oficiais indicadas. Dados sem fonte ficam como não publicados.
Só entram registros confirmados. Preços, planos e limites vêm de páginas oficiais indicadas. Ausências ficam como não publicados. As listas de resultados são alfabéticas por padrão e podem ser alteradas para Gratuito primeiro; nenhuma opção é um ranking de qualidade. A página do fornecedor prevalece.
Redação e verificação: equipe da AI Compare
Fontes
- https://developer.nvidia.com/topics/ai/nemotron
- https://build.nvidia.com/llms.txt
- https://build.nvidia.com/nvidia/nemotron-3-ultra-550b-a55b
- https://www.nvidia.com/en-us/about-nvidia/privacy-policy/
Visitar site (abre em uma nova aba)
Dado desatualizado? As páginas dos fornecedores mudam sem aviso. Reportar um erro