返回开发者专区官方定价 官方定价 官方定价 官方定价
xAI 模型
探索 xAI 的所有 4 个模型,包括详细定价、优缺点和开发者推荐。
4
模型
$0.200
最低输入价格
2M
最大上下文
2
质量层级
快速推荐
最佳性价比: Grok 4.1 Fast ($0.200/1M)
最佳质量: Grok 4.6
Grok 4.6
新增FlagshipCoding, math, reasoning
适用场景: Strong pick for coding agents and reasoning-heavy workloads when you want frontier quality below $5/M input.
核心升级
- ◆New xAI flagship at $2/$6 per 1M tokens — undercuts Grok 4.3's successors on capability-per-dollar
- ◆500K context, cached input at $0.50/M
- ◆Grok Build 0.1 coding stack ships alongside it in public beta
输入价格
$2.00
per 1M tokens
输出价格
$6.00
per 1M tokens
缓存输入
$0.500
per 1M tokens
批量输入
—
per 1M tokens
上下文窗口: 500K
最大输出: 32,000 tokens
知识截止日期: 2026-01
视觉函数调用微调JSON 模式
优点
- xAI's smartest model — frontier coding, knowledge work and STEM
- Configurable reasoning
- Fast variant available at 2x price
- Live in GitHub Copilot
缺点
- 500K context is below rivals' 1M
- No fine-tuning
性能
输出速度—
速率限制—
多模态能力
图像输入图像输出音频输入音频输出
Grok 4.3
Flagship通用用途,最大能力
适用场景: 最适合需要实时知识访问的通用应用的最佳xAI模型。
核心升级
- ◆100万上下文窗口 — 是Grok 3的128K的8倍
- ◆价格:$1.25/$2.50 — 比Grok 3($3/$15)便宜60%
- ◆实时网络 + X(Twitter)搜索 — 独特的实时知识访问
- ◆上下文缓存:$0.20/M — 重复前缀节省84%
- ◆最大输出32K — 是Grok 3的8K的4倍,适合长文本生成
输入价格
$1.25
per 1M tokens
输出价格
$2.50
per 1M tokens
缓存输入
$0.200
per 1M tokens
批量输入
—
per 1M tokens
上下文窗口: 1M
最大输出: 32,000 tokens
知识截止日期: 2025-06
视觉函数调用微调JSON 模式
优点
- 100万上下文窗口,输入$1.25/M
- 最智能的xAI模型
- 实时网络和X搜索
缺点
- 无批量API
- 无微调
- 较新的生态系统
性能
输出速度~65 tok/s
速率限制3,000 RPM
多模态能力
图像输入图像输出音频输入音频输出
基准测试
MMLU
87.5%
SWE-bench Verified
62.0%
GPQA
73.0%
Grok 4.1 Fast
Mid-tier成本优化的生产工作负载
适用场景: 最适合对延迟敏感的生产应用和预算有限的长文档处理。
核心升级
- ◆2M上下文窗口——所有中端模型中最大
- ◆$0.20/M输入——高容量任务比Grok 4.3便宜6倍
- ◆超低延迟——针对低于500ms响应时间优化
- ◆16K最大输出——是Grok 3的8K的两倍,适合更长生成
- ◆上下文缓存:$0.05/M——重复前缀节省75%
输入价格
$0.200
per 1M tokens
输出价格
$0.500
per 1M tokens
缓存输入
$0.050
per 1M tokens
批量输入
—
per 1M tokens
上下文窗口: 2M
最大输出: 16,000 tokens
知识截止日期: 2025-04
视觉函数调用微调JSON 模式
优点
- 2M上下文窗口——中端模型中最大
- 极快的响应时间
- 前沿API最低费率之一
缺点
- 质量低于Grok 4.3
- 无批量API
- 无微调
性能
输出速度~110 tok/s
速率限制8,000 RPM
多模态能力
图像输入图像输出音频输入音频输出
基准测试
MMLU
83.0%
HumanEval
80.0%
Grok 3
Flagship实时信息、分析
适用场景: 当需要实时X/Twitter数据或非常当前的知识时。
核心升级
- ◆实时X/Twitter集成——独特的实时社交媒体知识
- ◆知识截止日期:2025-02——目前最前沿之一
- ◆视觉+函数调用——发布时即具备完整多模态能力
- ◆无缓存或批处理API——升级到Grok 4.3以获得缓存支持
- ◆128K上下文——被Grok 4.3的1M上下文取代,适用于长文档任务
输入价格
$3.00
per 1M tokens
输出价格
$15.00
per 1M tokens
缓存输入
—
per 1M tokens
批量输入
—
per 1M tokens
上下文窗口: 131K
最大输出: 8,192 tokens
知识截止日期: 2025-02
视觉函数调用微调JSON 模式
优点
- 非常新的知识截止日期
- 实时X/Twitter集成
- 视觉+函数调用
缺点
- 昂贵($3/$15)
- 无缓存或批处理
- 无微调
性能
输出速度~55 tok/s
速率限制2,000 RPM
多模态能力
图像输入图像输出音频输入音频输出
基准测试
MMLU
85.0%
GPQA
68.0%
MATH
70.0%
并排比较
| 模型 | 层级 | 输入 | 输出 | 上下文 |
|---|---|---|---|---|
| Grok 4.6 | Flagship | $2.00 | $6.00 | 500K |
| Grok 4.3 | Flagship | $1.25 | $2.50 | 1M |
| Grok 4.1 Fast | Mid-tier | $0.200 | $0.500 | 2M |
| Grok 3 | Flagship | $3.00 | $15.00 | 131K |