返回开发者专区官方定价 官方定价
Meta 模型
探索 Meta 的所有 2 个模型,包括详细定价、优缺点和开发者推荐。
2
模型
$0.100
最低输入价格
10M
最大上下文
2
质量层级
快速推荐
最佳性价比: Llama 4 Scout ($0.100/1M)
最佳质量: Llama 4 Maverick
Llama 4 Maverick
Flagship开源、多模态
适用场景: 适用于希望获得开源控制或自托管且有多模态需求的团队。
核心升级
- ◆开源——免费自托管,完全控制模型权重
- ◆1M上下文窗口——首个具备此容量的开源模型
- ◆多模态(文本+视觉)+ 可微调——独特组合
- ◆17B活跃参数(总计109B)——MoE架构实现高效
- ◆4K最大输出有限——适用于输入密集、输出简短的任务
输入价格
$0.200
per 1M tokens
输出价格
$0.600
per 1M tokens
缓存输入
—
per 1M tokens
批量输入
—
per 1M tokens
上下文窗口: 1M
最大输出: 4,096 tokens
知识截止日期: 2024-08
视觉函数调用微调JSON 模式免费层级
优点
- 开源——可免费自托管
- 1M上下文窗口
- 多模态 + 可微调
缺点
- 仅4K最大输出
- 无JSON模式
- 通过第三方(Together AI)托管定价
性能
输出速度~80 tok/s
速率限制—
多模态能力
图像输入图像输出音频输入音频输出
基准测试
MMLU
84.5%
HumanEval
83.0%
SWE-bench Verified
44.2%
Llama 4 Scout
Mid-tier开源、长上下文
适用场景: 处理超长文档无与伦比。最适合具有巨大上下文窗口的RAG应用。
核心升级
- ◆1000万token上下文——比任何其他可用模型大10倍
- ◆开源+可微调——自托管实现无限使用
- ◆$0.10/M输入——市场上每token最便宜的模型
- ◆170亿活跃参数(总计1090亿)——与Maverick相同的高效MoE架构
- ◆4K最大输出——专为检索/分析设计,非长文本生成
输入价格
$0.100
per 1M tokens
输出价格
$0.300
per 1M tokens
缓存输入
—
per 1M tokens
批量输入
—
per 1M tokens
上下文窗口: 10M
最大输出: 4,096 tokens
知识截止日期: 2024-08
视觉函数调用微调JSON 模式免费层级
优点
- 1000万token上下文——目前最大可用
- 每token最便宜的模型
- 开源+可微调
缺点
- 仅4K最大输出
- 无JSON模式
- 质量低于专有旗舰模型
性能
输出速度~90 tok/s
速率限制—
多模态能力
图像输入图像输出音频输入音频输出
基准测试
MMLU
81.0%
HumanEval
78.5%
并排比较
| 模型 | 层级 | 输入 | 输出 | 上下文 |
|---|---|---|---|---|
| Llama 4 Maverick | Flagship | $0.200 | $0.600 | 1M |
| Llama 4 Scout | Mid-tier | $0.100 | $0.300 | 10M |