返回开发者专区官方定价 官方定价 官方定价 官方定价
DeepSeek 模型
探索 DeepSeek 的所有 4 个模型,包括详细定价、优缺点和开发者推荐。
4
模型
$0.220
最低输入价格
1M
最大上下文
2
质量层级
快速推荐
最佳性价比: DeepSeek V4 Flash ($0.220/1M)
最佳质量: DeepSeek V4 Flash
最佳推理: DeepSeek V4 Pro
DeepSeek V4 Pro
Reasoning深度推理,复杂分析
适用场景: 最佳预算推理模型,具有海量输出能力,适用于数学、逻辑和分析。
核心升级
- ◆384K最大输出——市场最大(是GPT-5.5的128K的3倍)
- ◆1M上下文窗口——比DeepSeek R1的65K增加16倍
- ◆比GPT-5.5推理便宜99%($0.435 vs $5/百万输入)
- ◆缓存输入:$0.003625/百万——重复前缀节省99.2%
- ◆思考模式:可切换的深度推理,无需额外成本
输入价格
$1.32
per 1M tokens
输出价格
$1.98
per 1M tokens
缓存输入
$0.022
per 1M tokens
批量输入
—
per 1M tokens
上下文窗口: 1M
最大输出: 384,000 tokens
知识截止日期: 2025-06
视觉函数调用微调JSON 模式
优点
- 384K最大输出——目前最大可用
- 1M上下文窗口
- 比GPT-5.5推理便宜99%
缺点
- 不支持视觉
- 不支持微调
- 思考模式增加令牌开销
性能
输出速度~30 tok/s
速率限制2,000 RPM
多模态能力
图像输入图像输出音频输入音频输出
基准测试
MMLU
88.0%
AIME 2024
85.0%
SWE-bench Verified
71.0%
MATH
82.5%
DeepSeek V4 Flash
Flagship超低价编码,通用任务
适用场景: 最适合高容量编码和通用任务,成本是首要考虑因素。
核心升级
- ◆最便宜的LLM:$0.14/M输入,$0.28/M输出
- ◆1M上下文 + 384K输出 — 与V4 Pro相同容量,价格仅为其1/3
- ◆双模式:思考和非思考 — 根据任务复杂度切换
- ◆缓存输入:$0.0028/M — 系统提示节省98%
- ◆无视觉 — 仅文本;多模态需求请使用GPT-4.1或Gemini
输入价格
$0.220
per 1M tokens
输出价格
$0.660
per 1M tokens
缓存输入
$0.0028
per 1M tokens
批量输入
—
per 1M tokens
上下文窗口: 1M
最大输出: 384,000 tokens
知识截止日期: 2025-06
视觉函数调用微调JSON 模式
优点
- 最便宜的LLM:$0.14/M输入
- 1M上下文 + 384K输出
- 支持思考和非思考模式
缺点
- 无视觉支持
- 复杂任务质量低于GPT-5.4
- 无微调
性能
输出速度~60 tok/s
速率限制5,000 RPM
多模态能力
图像输入图像输出音频输入音频输出
基准测试
MMLU
84.5%
HumanEval
86.0%
SWE-bench Verified
55.0%
DeepSeek V3
Flagship编码、数学、推理
适用场景: 最适合编码密集型工作负载的预算旗舰。质量与GPT-4.1相当,价格便宜10倍。
核心升级
- ◆比GPT-4.1便宜10倍($0.27 vs $2/M输入),编码能力相当
- ◆支持微调——可针对特定领域的编码任务进行定制
- ◆提示缓存:$0.07/M——重复系统提示节省74%
- ◆671B MoE参数,37B活跃——预算价格下的旗舰智能
- ◆65K上下文相比1M竞争对手较小——升级到V4以获得长上下文
输入价格
$0.270
per 1M tokens
输出价格
$1.10
per 1M tokens
缓存输入
$0.070
per 1M tokens
批量输入
—
per 1M tokens
上下文窗口: 66K
最大输出: 8,192 tokens
知识截止日期: 2024-07
视觉函数调用微调JSON 模式
优点
- 旗舰品质,价格极低
- 出色的编码和数学能力
- 支持微调和缓存
缺点
- 仅65K上下文
- 无视觉功能
- 函数调用可靠性有限
性能
输出速度~50 tok/s
速率限制3,000 RPM
多模态能力
图像输入图像输出音频输入音频输出
基准测试
MMLU
87.1%
SWE-bench Verified
50.0%
MATH
75.0%
HumanEval
89.0%
DeepSeek R1
Reasoning深度推理、数学证明
适用场景: 预算推理模型——当o3成本过高时,用于数学/逻辑管道的替代方案。
核心升级
- ◆比o3便宜4倍($0.55 vs $2/百万输入)用于可比推理
- ◆AIME 2024: 79.8%——在数学基准上与o1竞争
- ◆提示缓存:$0.14/百万——重复前缀节省75%
- ◆开源推理模型——自托管实现无限使用
- ◆无函数调用或视觉——纯推理;升级到V4 Pro以获取工具
输入价格
$0.550
per 1M tokens
输出价格
$2.19
per 1M tokens
缓存输入
$0.140
per 1M tokens
批量输入
—
per 1M tokens
上下文窗口: 66K
最大输出: 8,192 tokens
知识截止日期: 2024-07
视觉函数调用微调JSON 模式
优点
- 比o3推理便宜4倍
- 强大的数学和逻辑能力
- 良好的提示缓存节省
缺点
- 无函数调用
- 无视觉或微调
- 仅65K上下文
性能
输出速度~20 tok/s
速率限制2,000 RPM
多模态能力
图像输入图像输出音频输入音频输出
基准测试
AIME 2024
79.8%
MATH
97.3%
GPQA
71.5%
并排比较
| 模型 | 层级 | 输入 | 输出 | 上下文 |
|---|---|---|---|---|
| DeepSeek V4 Pro | Reasoning | $1.32 | $1.98 | 1M |
| DeepSeek V4 Flash | Flagship | $0.220 | $0.660 | 1M |
| DeepSeek V3 | Flagship | $0.270 | $1.10 | 66K |
| DeepSeek R1 | Reasoning | $0.550 | $2.19 | 66K |