Retour à l'espace développeur

NVIDIA Modèles

Explorez les 4 modèles de NVIDIA avec des prix détaillés, avantages et inconvénients, et recommandations pour développeurs.

4
Modèles
$0.050
Entrée la moins chère
1M
Contexte max
3
Niveaux de qualité

Recommandations rapides

Meilleur rapport qualité-prix: Nemotron-3-4B ($0.050/1M)
Meilleure qualité: Nemotron-3-Ultra

Nemotron-3-Ultra

Flagship

Raisonnement agentique, orchestration, planification complexe

Tarifs officiels

Quand l'utiliser: Charges de travail agentiques frontalières : planification multi-étapes, orchestration d'outils, chaînes de raisonnement complexes et déploiement d'agents en production.

Points clés de la mise à niveau

  • 550B MoE avec 55B actif — modèle de raisonnement frontalier ouvert
  • Hybride Mamba-Transformer : 300+ tok/s, contexte 1M
  • Conçu pour l'orchestration agentique et l'appel d'outils
  • Poids ouverts : déploiement avec NeMo, NIM ou auto-hébergé
  • 0,50 $/1M d'entrée — capacité frontalière au prix d'un modèle ouvert
Prix d'entrée
$0.500
per 1M tokens
Prix de sortie
$2.00
per 1M tokens
Entrée en cache
$0.130
per 1M tokens
Entrée batch
per 1M tokens
Fenêtre de contexte: 1M
Sortie max: 32,768 tokens
Date de coupure des connaissances: 2026-04
VisionAppel de fonctionAjustement finMode JSONNiveau gratuit

Avantages

  • 550B total / 55B actif — raisonnement frontalier ouvert
  • Architecture hybride Mamba-Transformer-MoE
  • Contexte 1M pour les tâches agentiques à long horizon
  • Débit de 300+ tokens/seconde
  • Poids ouverts avec personnalisation NeMo

Inconvénients

  • Pas de support visuel
  • 55B paramètres actifs nécessite toujours une puissance de calcul importante pour l'hébergement propre
  • Écosystème plus petit par rapport à OpenAI/Anthropic

Performance

Vitesse de sortie~90 tok/s
Limite de débit5,000 RPM

Multimodal

Entrée imageSortie imageEntrée audioSortie audio

Benchmarks

MMLU
88.5%
MT-Bench
9.4
BFCL
78.2%
AgentBench
72.6%

Nemotron-3-Nano-Omni

Lite

Agents multimodaux, compréhension vidéo/audio/image, déploiement en périphérie

Tarifs officiels

Quand l'utiliser: Agents IA multimodaux nécessitant une compréhension en temps réel de la vidéo, de l'audio et de l'image en périphérie. Intelligence documentaire, support client avec partage d'écran et analyse de contenu audiovisuel.

Points clés de la mise à niveau

  • Premier modèle omni NVIDIA : vision + audio + langage unifiés
  • 30B-A3B MoE — se déploie sur Jetson et DGX Spark
  • 9x de débit : mêmes performances, beaucoup moins de ressources
  • Raisonnement natif sur écran 1080p pour agents GUI
  • Poids ouvert : personnalisez avec NeMo pour des tâches spécifiques
Prix d'entrée
$0.100
per 1M tokens
Prix de sortie
$0.400
per 1M tokens
Entrée en cache
per 1M tokens
Entrée batch
per 1M tokens
Fenêtre de contexte: 262K
Sortie max: 8,192 tokens
Date de coupure des connaissances: 2026-04
VisionAppel de fonctionAjustement finMode JSONNiveau gratuit

Avantages

  • Omni-modal : vidéo + audio + image + texte dans un seul modèle
  • 30B total / 3B actif — fonctionne sur 25 Go de RAM
  • 9x de débit par rapport aux modèles omni ouverts comparables
  • Poids ouvert avec droits d'utilisation commerciale
  • Raisonnement visuel natif 1920x1080

Inconvénients

  • 3B paramètres actifs limite le raisonnement complexe
  • 8K sortie maximale
  • Fenêtre de contexte plus petite (256K)

Performance

Vitesse de sortie~200 tok/s
Limite de débit15,000 RPM

Multimodal

Entrée imageSortie imageEntrée audioSortie audio

Benchmarks

MMLU
71.2%
MMMU
65.8%
OSWorld
42.3%
DocVQA
92.1%

Nemotron-3-8B

Mid-tier

Génération de données synthétiques, modélisation de récompenses

Tarifs officiels

Quand l'utiliser: Génération de données d'entraînement synthétiques, modélisation de récompenses pour RLHF et workflows dans l'écosystème NVIDIA.

Points clés de la mise à niveau

  • Conçu spécialement pour la génération de données synthétiques — entraîner d'autres modèles
  • Modèle de récompense puissant : classe les réponses mieux qu'un juge GPT-4
  • Déploiement NVIDIA NIM — inférence optimisée sur GPU
  • Réglage fin avec le framework NeMo
  • 0,10 $/1M d'entrées — rentable pour la génération de données à grande échelle
Prix d'entrée
$0.100
per 1M tokens
Prix de sortie
$0.400
per 1M tokens
Entrée en cache
per 1M tokens
Entrée batch
per 1M tokens
Fenêtre de contexte: 128K
Sortie max: 4,096 tokens
Date de coupure des connaissances: 2025-03
VisionAppel de fonctionAjustement finMode JSONNiveau gratuit

Avantages

  • Optimisé pour la génération de données synthétiques
  • Forte capacité de modèle de récompense
  • Intégration dans l'écosystème NVIDIA
  • Prise en charge du réglage fin

Inconvénients

  • Sortie max de 4K
  • Pas de vision
  • La taille réduite du modèle limite les tâches complexes

Performance

Vitesse de sortie~100 tok/s
Limite de débit10,000 RPM

Multimodal

Entrée imageSortie imageEntrée audioSortie audio

Benchmarks

MMLU
73.8%
MT-Bench
8.2

Nemotron-3-4B

Lite

Données synthétiques légères, déploiement en périphérie

Tarifs officiels

Quand l'utiliser: Déploiement en périphérie, génération légère de données synthétiques et traitement par lots sensible aux coûts.

Points clés de la mise à niveau

  • 4B paramètres — se déploie sur Jetson et GPU périphériques
  • Génération de données synthétiques à 0,05 $/1M d'entrée
  • NVIDIA NIM : déploiement conteneurisé optimisé
  • Open-source : poids complets pour personnalisation
Prix d'entrée
$0.050
per 1M tokens
Prix de sortie
$0.200
per 1M tokens
Entrée en cache
per 1M tokens
Entrée batch
per 1M tokens
Fenêtre de contexte: 128K
Sortie max: 4,096 tokens
Date de coupure des connaissances: 2025-03
VisionAppel de fonctionAjustement finMode JSONNiveau gratuit

Avantages

  • Compact 4B — fonctionne sur GPU périphériques
  • Génération de données synthétiques
  • Optimisé NVIDIA NIM
  • Poids open-source

Inconvénients

  • Capacité de raisonnement limitée
  • Sortie max 4K
  • Pas de vision

Performance

Vitesse de sortie~180 tok/s
Limite de débit20,000 RPM

Multimodal

Entrée imageSortie imageEntrée audioSortie audio

Benchmarks

MMLU
66.5%
MT-Bench
7.1

Comparaison côte à côte

ModèleNiveauEntréeSortieContexte
Nemotron-3-UltraFlagship$0.500$2.001M
Nemotron-3-Nano-OmniLite$0.100$0.400262K
Nemotron-3-8BMid-tier$0.100$0.400128K
Nemotron-3-4BLite$0.050$0.200128K