Volver a la Zona de Desarrolladores

NVIDIA Modelos

Explora todos los 4 modelos de NVIDIA con precios detallados, ventajas y desventajas, y recomendaciones para desarrolladores.

4
Modelos
$0.050
Entrada Más Baja
1M
Contexto Máximo
3
Niveles de Calidad

Recomendaciones Rápidas

Mejor Relación Calidad-Precio: Nemotron-3-4B ($0.050/1M)
Mejor Calidad: Nemotron-3-Ultra

Nemotron-3-Ultra

Flagship

Razonamiento agéntico, orquestación, planificación compleja

Precios Oficiales

Cuándo usar: Cargas de trabajo agénticas fronterizas: planificación de múltiples pasos, orquestación de herramientas, cadenas de razonamiento complejas y despliegue de agentes en producción.

Mejoras clave

  • 550B MoE con 55B activo — modelo de razonamiento fronterizo abierto
  • Híbrido Mamba-Transformer: 300+ tok/s, contexto 1M
  • Diseñado para orquestación agéntica y llamada de herramientas
  • Pesos abiertos: despliegue con NeMo, NIM o autoalojado
  • $0.50/1M de entrada — capacidad fronteriza a precio de modelo abierto
Precio de Entrada
$0.500
per 1M tokens
Precio de Salida
$2.00
per 1M tokens
Entrada en Caché
$0.130
per 1M tokens
Entrada por Lote
per 1M tokens
Ventana de Contexto: 1M
Salida Máxima: 32,768 tokens
Fecha de Corte de Conocimiento: 2026-04
VisiónLlamada a FunciónAjuste FinoModo JSONNivel Gratuito

Ventajas

  • 550B total / 55B activo — razonamiento fronterizo abierto
  • Arquitectura híbrida Mamba-Transformer-MoE
  • Contexto de 1M para tareas agénticas de largo horizonte
  • Rendimiento de 300+ tokens/segundo
  • Pesos abiertos con personalización NeMo

Desventajas

  • Sin soporte de visión
  • 55B parámetros activos aún requiere potencia de cómputo significativa para autoalojamiento
  • Ecosistema más pequeño en comparación con OpenAI/Anthropic

Rendimiento

Velocidad de salida~90 tok/s
Límite de tasa5,000 RPM

Multimodal

Entrada de imagenSalida de imagenEntrada de audioSalida de audio

Benchmarks

MMLU
88.5%
MT-Bench
9.4
BFCL
78.2%
AgentBench
72.6%

Nemotron-3-Nano-Omni

Lite

Agentes multimodales, comprensión de video/audio/imagen, implementación en el borde

Precios Oficiales

Cuándo usar: Agentes de IA multimodales que necesitan comprensión en tiempo real de video, audio e imagen en el borde. Inteligencia documental, atención al cliente con uso compartido de pantalla y análisis de contenido audiovisual.

Mejoras clave

  • Primer modelo omni de NVIDIA: visión + audio + lenguaje unificados
  • 30B-A3B MoE — se implementa en Jetson y DGX Spark
  • 9x de rendimiento: mismo rendimiento, muchos menos recursos
  • Razonamiento nativo en pantalla 1080p para agentes GUI
  • Peso abierto: personalice con NeMo para tareas específicas
Precio de Entrada
$0.100
per 1M tokens
Precio de Salida
$0.400
per 1M tokens
Entrada en Caché
per 1M tokens
Entrada por Lote
per 1M tokens
Ventana de Contexto: 262K
Salida Máxima: 8,192 tokens
Fecha de Corte de Conocimiento: 2026-04
VisiónLlamada a FunciónAjuste FinoModo JSONNivel Gratuito

Ventajas

  • Omni-modal: video + audio + imagen + texto en un solo modelo
  • 30B total / 3B activo — funciona con 25 GB de RAM
  • 9x de rendimiento frente a modelos omni abiertos comparables
  • Peso abierto con derechos de uso comercial
  • Razonamiento visual nativo 1920x1080

Desventajas

  • 3B parámetros activos limita el razonamiento complejo
  • 8K salida máxima
  • Ventana de contexto más pequeña (256K)

Rendimiento

Velocidad de salida~200 tok/s
Límite de tasa15,000 RPM

Multimodal

Entrada de imagenSalida de imagenEntrada de audioSalida de audio

Benchmarks

MMLU
71.2%
MMMU
65.8%
OSWorld
42.3%
DocVQA
92.1%

Nemotron-3-8B

Mid-tier

Generación de datos sintéticos, modelado de recompensas

Precios Oficiales

Cuándo usar: Generación de datos de entrenamiento sintéticos, modelado de recompensas para RLHF y flujos de trabajo del ecosistema NVIDIA.

Mejoras clave

  • Diseñado específicamente para generación de datos sintéticos — entrenar otros modelos
  • Modelo de recompensa fuerte: clasifica respuestas mejor que un juez GPT-4
  • Despliegue NVIDIA NIM — inferencia optimizada en GPU
  • Ajuste fino con el framework NeMo
  • $0.10/1M de entrada — rentable para generación de datos a escala
Precio de Entrada
$0.100
per 1M tokens
Precio de Salida
$0.400
per 1M tokens
Entrada en Caché
per 1M tokens
Entrada por Lote
per 1M tokens
Ventana de Contexto: 128K
Salida Máxima: 4,096 tokens
Fecha de Corte de Conocimiento: 2025-03
VisiónLlamada a FunciónAjuste FinoModo JSONNivel Gratuito

Ventajas

  • Optimizado para generación de datos sintéticos
  • Capacidades sólidas de modelo de recompensa
  • Integración con el ecosistema NVIDIA
  • Soporte de ajuste fino

Desventajas

  • Salida máxima de 4K
  • Sin visión
  • El tamaño reducido del modelo limita tareas complejas

Rendimiento

Velocidad de salida~100 tok/s
Límite de tasa10,000 RPM

Multimodal

Entrada de imagenSalida de imagenEntrada de audioSalida de audio

Benchmarks

MMLU
73.8%
MT-Bench
8.2

Nemotron-3-4B

Lite

Datos sintéticos ligeros, implementación en el borde

Precios Oficiales

Cuándo usar: Implementación en el borde, generación ligera de datos sintéticos y procesamiento por lotes sensible al costo.

Mejoras clave

  • 4B parámetros — se despliega en Jetson y GPU de borde
  • Generación de datos sintéticos a $0.05/1M de entrada
  • NVIDIA NIM: implementación contenerizada optimizada
  • Código abierto: pesos completos para personalización
Precio de Entrada
$0.050
per 1M tokens
Precio de Salida
$0.200
per 1M tokens
Entrada en Caché
per 1M tokens
Entrada por Lote
per 1M tokens
Ventana de Contexto: 128K
Salida Máxima: 4,096 tokens
Fecha de Corte de Conocimiento: 2025-03
VisiónLlamada a FunciónAjuste FinoModo JSONNivel Gratuito

Ventajas

  • Compacto 4B — funciona en GPU de borde
  • Generación de datos sintéticos
  • Optimizado para NVIDIA NIM
  • Pesos de código abierto

Desventajas

  • Capacidad de razonamiento limitada
  • Salida máxima de 4K
  • Sin visión

Rendimiento

Velocidad de salida~180 tok/s
Límite de tasa20,000 RPM

Multimodal

Entrada de imagenSalida de imagenEntrada de audioSalida de audio

Benchmarks

MMLU
66.5%
MT-Bench
7.1

Comparación Lado a Lado

ModeloNivelEntradaSalidaContexto
Nemotron-3-UltraFlagship$0.500$2.001M
Nemotron-3-Nano-OmniLite$0.100$0.400262K
Nemotron-3-8BMid-tier$0.100$0.400128K
Nemotron-3-4BLite$0.050$0.200128K