NVIDIA Nemotron
Familia abierta de modelos de NVIDIA con pesos, datos de entrenamiento y guías de preparación para agentes de IA especializados, más una API de prototipo vía NVIDIA NIM.
Categoría: Desarrollo y Código · Frameworks de agentes y RAG
Funciones
NVIDIA Nemotron no es una app de chat con plan mensual. Es una familia abierta de modelos para agentes, con API de prototipo y autoalojamiento.
- Pesos, datos de entrenamiento y guías de preparación abiertos; la página temática nombra la descarga en Hugging Face
- Nemotron 3: MoE híbrido Mamba-Transformer, contexto de hasta 1 millón de tokens según NVIDIA
- Nemotron 3.5 Lightning: MoE abierto de 30B con 3B de parámetros activos para agentes siempre activos
- También nombra Ultra 550B A55B, Super 120B A12B, Nano 30B A3B y Nano Omni 30B A3B, además de Retriever, Parse, Speech y Safety
- API de prototipo sin tarjeta de crédito; URL base https://integrate.api.nvidia.com/v1, OpenAI Chat Completions
- Ejecución con vLLM, SGLang, Ollama, llama.cpp y NVIDIA NIM
Precios y planes
| Plan | Precio | Periodo | Qué incluye |
|---|---|---|---|
| API de prototipo | gratis | acceso de prueba gratis, sin precio por token | FAQ, literal: 'All models offer a free trial tier with no credit card required.' URL base https://integrate.api.nvidia.com/v1, autenticación con una clave de API de NVIDIA Los mismos endpoints implementan la API OpenAI Chat Completions Modelo de ejemplo en la página de Ultra: nvidia/nemotron-3-ultra-550b-a55b |
| Producción | a consultar | endpoint de socio o NIM autoalojado | Página de Ultra: prototipo en el endpoint de API gratis y escala con endpoints de socios o despliegue autoalojado La página temática no publica un precio único de NVIDIA por token para la familia Los precios de cada socio son de ese proveedor, no un precio de lista de NVIDIA |
Límites
Los modelos se pueden autoalojar. El prototipo alojado funciona en build.nvidia.com. La página temática indica hasta 1 millón de tokens de contexto para la familia Nemotron 3; es una cifra de la familia, no una ventana de contexto comprobada para cada modelo individual. Allí no hay un precio de lista único de NVIDIA por token para producción. La producción usa los endpoints de socios citados o un NIM autoalojado. La página no dice si los prompts de la API de prototipo se usan para el entrenamiento.
Alternativas y herramientas similares a NVIDIA Nemotron
FAQ
¿NVIDIA Nemotron tiene una opción gratuita?
No de forma permanente. Lo publicado es una prueba gratuita limitada.
¿Dónde tiene su sede el proveedor de NVIDIA Nemotron?
NVIDIA Corporation tiene su sede en Estados Unidos. Independientemente de la sede, el tratamiento de datos y la privacidad se rigen por el contrato del proveedor.
¿Cuántos planes hay documentados para NVIDIA Nemotron?
El catálogo documenta 2 planes con precio, periodo de facturación y prestaciones incluidas.
¿NVIDIA Nemotron sigue activo?
NVIDIA Nemotron sigue activo: Familia abierta de modelos con API de prototipo en build.nvidia.com y pesos descargables. No es un chat de consumo con plan mensual.
¿Cuántas fuentes oficiales hay registradas para NVIDIA Nemotron?
Para NVIDIA Nemotron hay 4 fuentes oficiales registradas, en las que se basan los precios y límites.
Cómo comparamos
Comparamos acceso gratis, entrada de pago, límites del plan, funciones y las fuentes oficiales indicadas. Lo no verificado queda como no publicado.
Solo aparecen entradas confirmadas. Precios, planes y límites vienen de páginas oficiales indicadas. Lo ausente queda como no publicado. Las listas de resultados son alfabéticas por defecto y pueden cambiarse a Gratis primero; ninguna opción es un ranking de calidad. Gana siempre la página del proveedor.
Redacción y verificación: equipo de AI Compare
Fuentes
- https://developer.nvidia.com/topics/ai/nemotron
- https://build.nvidia.com/llms.txt
- https://build.nvidia.com/nvidia/nemotron-3-ultra-550b-a55b
- https://www.nvidia.com/en-us/about-nvidia/privacy-policy/
Visitar sitio (se abre en una pestaña nueva)
¿Dato desactualizado? Las páginas de los proveedores cambian sin aviso. Reportar un error