Назад в зону разработчика

NVIDIA Модели

Изучите все 4 моделей от NVIDIA с подробными ценами, плюсами и минусами, а также рекомендациями для разработчиков.

4
Модели
$0.050
Самая низкая входная цена
1M
Макс. контекст
3
Уровни качества

Быстрые рекомендации

Лучшее соотношение цены и качества: Nemotron-3-4B ($0.050/1M)
Лучшее качество: Nemotron-3-Ultra

Nemotron-3-Ultra

Flagship

Агентное рассуждение, оркестрация, сложное планирование

Официальные цены

Когда использовать: Пограничные агентные нагрузки: многошаговое планирование, оркестрация инструментов, сложные цепочки рассуждений и развертывание производственных агентов.

Ключевые улучшения

  • 550B MoE с 55B активными — открытая модель рассуждения на границе возможностей
  • Гибрид Mamba-Transformer: 300+ ток/сек, контекст 1M
  • Создана специально для агентной оркестрации и вызова инструментов
  • Открытые веса: развертывание с NeMo, NIM или самостоятельно
  • $0.50/1M входных данных — возможности на границе по цене открытых моделей
Цена входа
$0.500
per 1M tokens
Цена выхода
$2.00
per 1M tokens
Кэшированный вход
$0.130
per 1M tokens
Пакетный вход
per 1M tokens
Окно контекста: 1M
Макс. выход: 32,768 tokens
Дата обрезания знаний: 2026-04
ЗрениеВызов функцийТонкая настройкаРежим JSONБесплатный уровень

Плюсы

  • 550B всего / 55B активных — открытое рассуждение на границе возможностей
  • Гибридная архитектура Mamba-Transformer-MoE
  • Контекст 1M для долгосрочных агентных задач
  • Пропускная способность 300+ токенов/сек
  • Открытые веса с кастомизацией NeMo

Минусы

  • Отсутствие поддержки зрения
  • 55B активных параметров все еще требуют значительных вычислительных ресурсов для самостоятельного хостинга
  • Меньшая экосистема по сравнению с OpenAI/Anthropic

Производительность

Скорость вывода~90 tok/s
Ограничение скорости5,000 RPM

Мультимодальность

Ввод изображенияВывод изображенияВвод аудиоВывод аудио

Бенчмарки

MMLU
88.5%
MT-Bench
9.4
BFCL
78.2%
AgentBench
72.6%

Nemotron-3-Nano-Omni

Lite

Мультимодальные агенты, понимание видео/аудио/изображений, развертывание на периферии

Официальные цены

Когда использовать: Мультимодальные AI-агенты, которым требуется понимание видео, аудио и изображений в реальном времени на периферии. Интеллектуальный анализ документов, поддержка клиентов с демонстрацией экрана и анализ аудиовизуального контента.

Ключевые улучшения

  • Первая NVIDIA омнимодель: зрение + аудио + язык объединены
  • 30B-A3B MoE — развертывается на Jetson и DGX Spark
  • 9x пропускная способность: та же производительность, гораздо меньше ресурсов
  • Нативное рассуждение на экране 1080p для GUI-агентов
  • Открытые веса: настройка с NeMo для доменных задач
Цена входа
$0.100
per 1M tokens
Цена выхода
$0.400
per 1M tokens
Кэшированный вход
per 1M tokens
Пакетный вход
per 1M tokens
Окно контекста: 262K
Макс. выход: 8,192 tokens
Дата обрезания знаний: 2026-04
ЗрениеВызов функцийТонкая настройкаРежим JSONБесплатный уровень

Плюсы

  • Омнимодальный: видео + аудио + изображения + текст в одной модели
  • 30B всего / 3B активных — работает на 25 ГБ ОЗУ
  • 9x пропускная способность по сравнению с сопоставимыми открытыми омнимоделями
  • Открытые веса с правами коммерческого использования
  • Нативное визуальное рассуждение 1920x1080

Минусы

  • 3B активных параметров ограничивает сложное рассуждение
  • Максимальный вывод 8K
  • Меньший контекстный окно (256K)

Производительность

Скорость вывода~200 tok/s
Ограничение скорости15,000 RPM

Мультимодальность

Ввод изображенияВывод изображенияВвод аудиоВывод аудио

Бенчмарки

MMLU
71.2%
MMMU
65.8%
OSWorld
42.3%
DocVQA
92.1%

Nemotron-3-8B

Mid-tier

Генерация синтетических данных, моделирование вознаграждений

Официальные цены

Когда использовать: Генерация синтетических обучающих данных, моделирование вознаграждений для RLHF и рабочие процессы экосистемы NVIDIA.

Ключевые улучшения

  • Создан специально для генерации синтетических данных — обучение других моделей
  • Мощная модель вознаграждения: ранжирует ответы лучше, чем судья GPT-4
  • Развертывание NVIDIA NIM — оптимизированный вывод на GPU
  • Тонкая настройка с помощью фреймворка NeMo
  • $0.10/1M ввод — экономически эффективно для масштабной генерации данных
Цена входа
$0.100
per 1M tokens
Цена выхода
$0.400
per 1M tokens
Кэшированный вход
per 1M tokens
Пакетный вход
per 1M tokens
Окно контекста: 128K
Макс. выход: 4,096 tokens
Дата обрезания знаний: 2025-03
ЗрениеВызов функцийТонкая настройкаРежим JSONБесплатный уровень

Плюсы

  • Оптимизирован для генерации синтетических данных
  • Мощные возможности модели вознаграждения
  • Интеграция с экосистемой NVIDIA
  • Поддержка тонкой настройки

Минусы

  • Максимальный вывод 4K
  • Нет поддержки зрения
  • Меньший размер модели ограничивает сложные задачи

Производительность

Скорость вывода~100 tok/s
Ограничение скорости10,000 RPM

Мультимодальность

Ввод изображенияВывод изображенияВвод аудиоВывод аудио

Бенчмарки

MMLU
73.8%
MT-Bench
8.2

Nemotron-3-4B

Lite

Легкие синтетические данные, развертывание на периферии

Официальные цены

Когда использовать: Развертывание на периферии, легкая генерация синтетических данных и пакетная обработка с учетом затрат.

Ключевые улучшения

  • 4B параметров — развертывается на Jetson и периферийных GPU
  • Генерация синтетических данных по цене $0.05/1M входных данных
  • NVIDIA NIM: оптимизированное контейнерное развертывание
  • Открытый исходный код: полные веса для настройки
Цена входа
$0.050
per 1M tokens
Цена выхода
$0.200
per 1M tokens
Кэшированный вход
per 1M tokens
Пакетный вход
per 1M tokens
Окно контекста: 128K
Макс. выход: 4,096 tokens
Дата обрезания знаний: 2025-03
ЗрениеВызов функцийТонкая настройкаРежим JSONБесплатный уровень

Плюсы

  • Компактный 4B — работает на периферийных GPU
  • Генерация синтетических данных
  • Оптимизирован для NVIDIA NIM
  • Открытые веса

Минусы

  • Ограниченные возможности рассуждения
  • Максимальный вывод 4K
  • Нет зрения

Производительность

Скорость вывода~180 tok/s
Ограничение скорости20,000 RPM

Мультимодальность

Ввод изображенияВывод изображенияВвод аудиоВывод аудио

Бенчмарки

MMLU
66.5%
MT-Bench
7.1

Сравнение бок о бок

МодельУровеньВходВыходКонтекст
Nemotron-3-UltraFlagship$0.500$2.001M
Nemotron-3-Nano-OmniLite$0.100$0.400262K
Nemotron-3-8BMid-tier$0.100$0.400128K
Nemotron-3-4BLite$0.050$0.200128K