返回开发者专区官方定价 官方定价 官方定价
Mistral 模型
探索 Mistral 的所有 3 个模型,包括详细定价、优缺点和开发者推荐。
3
模型
$0.400
最低输入价格
131K
最大上下文
2
质量层级
快速推荐
最佳性价比: Mistral Medium 3 ($0.400/1M)
最佳质量: Mistral Large 2
Mistral Large 2
Flagship多语言、复杂任务
适用场景: 多语言企业应用的首选,尤其是欧盟部署场景。
核心升级
- ◆MMLU: 84.0% — 与GPT-4级别模型竞争
- ◆支持微调 — 可针对特定领域任务定制
- ◆基于欧盟(符合GDPR) — 唯一具有欧盟主权的主要旗舰模型
- ◆优化12种语言 — 在法语、德语、西班牙语中表现最佳
- ◆128K上下文小于竞争对手的1M — 为符合欧盟法规而做出的权衡
输入价格
$2.00
per 1M tokens
输出价格
$6.00
per 1M tokens
缓存输入
—
per 1M tokens
批量输入
—
per 1M tokens
上下文窗口: 131K
最大输出: 8,192 tokens
知识截止日期: 2024-07
视觉函数调用微调JSON 模式免费层级
优点
- 出色的多语言能力(法语、德语等)
- 支持微调
- 基于欧盟(符合GDPR)
缺点
- 无视觉功能
- 128K上下文相比竞争对手较小
- 无缓存/批量定价
性能
输出速度~55 tok/s
速率限制3,000 RPM
多模态能力
图像输入图像输出音频输入音频输出
基准测试
MMLU
84.0%
HumanEval
82.0%
MATH
65.0%
Mistral Medium 3
Mid-tier均衡的多语言能力
适用场景: 面向欧洲市场应用的经济高效的多语言+视觉解决方案。
核心升级
- ◆中端产品新增视觉功能——多模态能力,输入成本$0.40/百万
- ◆轻量任务比Mistral Large便宜5倍($0.40 vs $2/百万)
- ◆基于欧盟的基础设施——符合GDPR的欧洲数据处理
- ◆128K上下文——足以处理大多数企业文档
- ◆无微调——升级至Large 2以进行自定义模型训练
输入价格
$0.400
per 1M tokens
输出价格
$2.00
per 1M tokens
缓存输入
—
per 1M tokens
批量输入
—
per 1M tokens
上下文窗口: 131K
最大输出: 8,192 tokens
知识截止日期: 2024-07
视觉函数调用微调JSON 模式免费层级
优点
- 中端价格提供视觉功能
- 良好的多语言平衡
- 基于欧盟
缺点
- 无微调功能
- 无缓存/批量定价
- 上下文窗口小于竞争对手
性能
输出速度~75 tok/s
速率限制5,000 RPM
多模态能力
图像输入图像输出音频输入音频输出
基准测试
MMLU
80.5%
HumanEval
78.0%
Mixtral 8x22B
Mid-tier开放权重,高吞吐量
适用场景: 适用于自托管或对领域特定数据进行微调,且需要高吞吐量的场景。
核心升级
- ◆开放权重的MoE:8x22B参数,每个token仅激活39B参数——高吞吐量
- ◆可微调——完全访问权重以进行领域适应
- ◆函数调用+JSON模式——企业级工具集成
- ◆65K上下文——比新模型小,但足以应对大多数任务
- ◆可自托管——在自有基础设施上运行时无需按token付费
输入价格
$0.900
per 1M tokens
输出价格
$2.70
per 1M tokens
缓存输入
—
per 1M tokens
批量输入
—
per 1M tokens
上下文窗口: 66K
最大输出: 4,096 tokens
知识截止日期: 2024-01
视觉函数调用微调JSON 模式免费层级
优点
- 开放权重的MoE架构
- 可微调
- 通过稀疏激活实现高吞吐量
缺点
- 仅65K上下文
- 无视觉功能
- 知识截止日期较旧(2024-01)
性能
输出速度~85 tok/s
速率限制—
多模态能力
图像输入图像输出音频输入音频输出
基准测试
MMLU
77.8%
HumanEval
75.5%
MATH
58.0%
并排比较
| 模型 | 层级 | 输入 | 输出 | 上下文 |
|---|---|---|---|---|
| Mistral Large 2 | Flagship | $2.00 | $6.00 | 131K |
| Mistral Medium 3 | Mid-tier | $0.400 | $2.00 | 131K |
| Mixtral 8x22B | Mid-tier | $0.900 | $2.70 | 66K |