Назад в зону разработчика

Meta Модели

Изучите все 2 моделей от Meta с подробными ценами, плюсами и минусами, а также рекомендациями для разработчиков.

2
Модели
$0.100
Самая низкая входная цена
10M
Макс. контекст
2
Уровни качества

Быстрые рекомендации

Лучшее соотношение цены и качества: Llama 4 Scout ($0.100/1M)
Лучшее качество: Llama 4 Maverick

Llama 4 Maverick

Flagship

Открытый исходный код, мультимодальный

Официальные цены

Когда использовать: Для команд, желающих контроля с открытым исходным кодом или самостоятельного развертывания с мультимодальными потребностями.

Ключевые улучшения

  • Открытый исходный код — разверните бесплатно, полный контроль весов модели
  • Окно контекста 1M — первая модель с открытым исходным кодом с такой емкостью
  • Мультимодальный (текст + зрение) + возможность тонкой настройки — уникальное сочетание
  • 17B активных параметров (109B всего) — архитектура MoE для эффективности
  • Максимальный вывод 4K ограничивает — используйте для задач с большим вводом и коротким выводом
Цена входа
$0.200
per 1M tokens
Цена выхода
$0.600
per 1M tokens
Кэшированный вход
per 1M tokens
Пакетный вход
per 1M tokens
Окно контекста: 1M
Макс. выход: 4,096 tokens
Дата обрезания знаний: 2024-08
ЗрениеВызов функцийТонкая настройкаРежим JSONБесплатный уровень

Плюсы

  • Открытый исходный код — можно развернуть бесплатно
  • Окно контекста 1M
  • Мультимодальный + возможность тонкой настройки

Минусы

  • Максимальный вывод только 4K
  • Нет режима JSON
  • Ценообразование хостинга через стороннего провайдера (Together AI)

Производительность

Скорость вывода~80 tok/s
Ограничение скорости

Мультимодальность

Ввод изображенияВывод изображенияВвод аудиоВывод аудио

Бенчмарки

MMLU
84.5%
HumanEval
83.0%
SWE-bench Verified
44.2%

Llama 4 Scout

Mid-tier

Открытый исходный код, длинный контекст

Официальные цены

Когда использовать: Непревзойден для обработки очень длинных документов. Лучший выбор для RAG с огромными контекстными окнами.

Ключевые улучшения

  • Контекст в 10 млн токенов — в 10 раз больше, чем у любой другой доступной модели
  • Открытый исходный код + возможность тонкой настройки — самостоятельное размещение для неограниченного использования
  • $0.10/M ввод — самая дешевая модель за токен на рынке
  • 17B активных параметров (109B всего) — та же эффективная MoE, что и у Maverick
  • Максимальный вывод 4K — предназначен для поиска/анализа, а не для длительной генерации
Цена входа
$0.100
per 1M tokens
Цена выхода
$0.300
per 1M tokens
Кэшированный вход
per 1M tokens
Пакетный вход
per 1M tokens
Окно контекста: 10M
Макс. выход: 4,096 tokens
Дата обрезания знаний: 2024-08
ЗрениеВызов функцийТонкая настройкаРежим JSONБесплатный уровень

Плюсы

  • Контекст в 10 млн токенов — самый большой из доступных
  • Самая дешевая модель за токен
  • Открытый исходный код + возможность тонкой настройки

Минусы

  • Максимальный вывод всего 4K
  • Нет режима JSON
  • Качество ниже проприетарных флагманов

Производительность

Скорость вывода~90 tok/s
Ограничение скорости

Мультимодальность

Ввод изображенияВывод изображенияВвод аудиоВывод аудио

Бенчмарки

MMLU
81.0%
HumanEval
78.5%

Сравнение бок о бок

МодельУровеньВходВыходКонтекст
Llama 4 MaverickFlagship$0.200$0.6001M
Llama 4 ScoutMid-tier$0.100$0.30010M