Назад в зону разработчикаОфициальные цены Официальные цены
Meta Модели
Изучите все 2 моделей от Meta с подробными ценами, плюсами и минусами, а также рекомендациями для разработчиков.
2
Модели
$0.100
Самая низкая входная цена
10M
Макс. контекст
2
Уровни качества
Быстрые рекомендации
Лучшее соотношение цены и качества: Llama 4 Scout ($0.100/1M)
Лучшее качество: Llama 4 Maverick
Llama 4 Maverick
FlagshipОткрытый исходный код, мультимодальный
Когда использовать: Для команд, желающих контроля с открытым исходным кодом или самостоятельного развертывания с мультимодальными потребностями.
Ключевые улучшения
- ◆Открытый исходный код — разверните бесплатно, полный контроль весов модели
- ◆Окно контекста 1M — первая модель с открытым исходным кодом с такой емкостью
- ◆Мультимодальный (текст + зрение) + возможность тонкой настройки — уникальное сочетание
- ◆17B активных параметров (109B всего) — архитектура MoE для эффективности
- ◆Максимальный вывод 4K ограничивает — используйте для задач с большим вводом и коротким выводом
Цена входа
$0.200
per 1M tokens
Цена выхода
$0.600
per 1M tokens
Кэшированный вход
—
per 1M tokens
Пакетный вход
—
per 1M tokens
Окно контекста: 1M
Макс. выход: 4,096 tokens
Дата обрезания знаний: 2024-08
ЗрениеВызов функцийТонкая настройкаРежим JSONБесплатный уровень
Плюсы
- Открытый исходный код — можно развернуть бесплатно
- Окно контекста 1M
- Мультимодальный + возможность тонкой настройки
Минусы
- Максимальный вывод только 4K
- Нет режима JSON
- Ценообразование хостинга через стороннего провайдера (Together AI)
Производительность
Скорость вывода~80 tok/s
Ограничение скорости—
Мультимодальность
Ввод изображенияВывод изображенияВвод аудиоВывод аудио
Бенчмарки
MMLU
84.5%
HumanEval
83.0%
SWE-bench Verified
44.2%
Llama 4 Scout
Mid-tierОткрытый исходный код, длинный контекст
Когда использовать: Непревзойден для обработки очень длинных документов. Лучший выбор для RAG с огромными контекстными окнами.
Ключевые улучшения
- ◆Контекст в 10 млн токенов — в 10 раз больше, чем у любой другой доступной модели
- ◆Открытый исходный код + возможность тонкой настройки — самостоятельное размещение для неограниченного использования
- ◆$0.10/M ввод — самая дешевая модель за токен на рынке
- ◆17B активных параметров (109B всего) — та же эффективная MoE, что и у Maverick
- ◆Максимальный вывод 4K — предназначен для поиска/анализа, а не для длительной генерации
Цена входа
$0.100
per 1M tokens
Цена выхода
$0.300
per 1M tokens
Кэшированный вход
—
per 1M tokens
Пакетный вход
—
per 1M tokens
Окно контекста: 10M
Макс. выход: 4,096 tokens
Дата обрезания знаний: 2024-08
ЗрениеВызов функцийТонкая настройкаРежим JSONБесплатный уровень
Плюсы
- Контекст в 10 млн токенов — самый большой из доступных
- Самая дешевая модель за токен
- Открытый исходный код + возможность тонкой настройки
Минусы
- Максимальный вывод всего 4K
- Нет режима JSON
- Качество ниже проприетарных флагманов
Производительность
Скорость вывода~90 tok/s
Ограничение скорости—
Мультимодальность
Ввод изображенияВывод изображенияВвод аудиоВывод аудио
Бенчмарки
MMLU
81.0%
HumanEval
78.5%
Сравнение бок о бок
| Модель | Уровень | Вход | Выход | Контекст |
|---|---|---|---|---|
| Llama 4 Maverick | Flagship | $0.200 | $0.600 | 1M |
| Llama 4 Scout | Mid-tier | $0.100 | $0.300 | 10M |