返回开发者专区

DeepSeek 模型

探索 DeepSeek 的所有 4 个模型,包括详细定价、优缺点和开发者推荐。

4
模型
$0.220
最低输入价格
1M
最大上下文
2
质量层级

快速推荐

最佳性价比: DeepSeek V4 Flash ($0.220/1M)
最佳质量: DeepSeek V4 Flash
最佳推理: DeepSeek V4 Pro

DeepSeek V4 Pro

Reasoning

深度推理,复杂分析

官方定价

适用场景: 最佳预算推理模型,具有海量输出能力,适用于数学、逻辑和分析。

核心升级

  • 384K最大输出——市场最大(是GPT-5.5的128K的3倍)
  • 1M上下文窗口——比DeepSeek R1的65K增加16倍
  • 比GPT-5.5推理便宜99%($0.435 vs $5/百万输入)
  • 缓存输入:$0.003625/百万——重复前缀节省99.2%
  • 思考模式:可切换的深度推理,无需额外成本
输入价格
$1.32
per 1M tokens
输出价格
$1.98
per 1M tokens
缓存输入
$0.022
per 1M tokens
批量输入
per 1M tokens
上下文窗口: 1M
最大输出: 384,000 tokens
知识截止日期: 2025-06
视觉函数调用微调JSON 模式

优点

  • 384K最大输出——目前最大可用
  • 1M上下文窗口
  • 比GPT-5.5推理便宜99%

缺点

  • 不支持视觉
  • 不支持微调
  • 思考模式增加令牌开销

性能

输出速度~30 tok/s
速率限制2,000 RPM

多模态能力

图像输入图像输出音频输入音频输出

基准测试

MMLU
88.0%
AIME 2024
85.0%
SWE-bench Verified
71.0%
MATH
82.5%

DeepSeek V4 Flash

Flagship

超低价编码,通用任务

官方定价

适用场景: 最适合高容量编码和通用任务,成本是首要考虑因素。

核心升级

  • 最便宜的LLM:$0.14/M输入,$0.28/M输出
  • 1M上下文 + 384K输出 — 与V4 Pro相同容量,价格仅为其1/3
  • 双模式:思考和非思考 — 根据任务复杂度切换
  • 缓存输入:$0.0028/M — 系统提示节省98%
  • 无视觉 — 仅文本;多模态需求请使用GPT-4.1或Gemini
输入价格
$0.220
per 1M tokens
输出价格
$0.660
per 1M tokens
缓存输入
$0.0028
per 1M tokens
批量输入
per 1M tokens
上下文窗口: 1M
最大输出: 384,000 tokens
知识截止日期: 2025-06
视觉函数调用微调JSON 模式

优点

  • 最便宜的LLM:$0.14/M输入
  • 1M上下文 + 384K输出
  • 支持思考和非思考模式

缺点

  • 无视觉支持
  • 复杂任务质量低于GPT-5.4
  • 无微调

性能

输出速度~60 tok/s
速率限制5,000 RPM

多模态能力

图像输入图像输出音频输入音频输出

基准测试

MMLU
84.5%
HumanEval
86.0%
SWE-bench Verified
55.0%

DeepSeek V3

Flagship

编码、数学、推理

官方定价

适用场景: 最适合编码密集型工作负载的预算旗舰。质量与GPT-4.1相当,价格便宜10倍。

核心升级

  • 比GPT-4.1便宜10倍($0.27 vs $2/M输入),编码能力相当
  • 支持微调——可针对特定领域的编码任务进行定制
  • 提示缓存:$0.07/M——重复系统提示节省74%
  • 671B MoE参数,37B活跃——预算价格下的旗舰智能
  • 65K上下文相比1M竞争对手较小——升级到V4以获得长上下文
输入价格
$0.270
per 1M tokens
输出价格
$1.10
per 1M tokens
缓存输入
$0.070
per 1M tokens
批量输入
per 1M tokens
上下文窗口: 66K
最大输出: 8,192 tokens
知识截止日期: 2024-07
视觉函数调用微调JSON 模式

优点

  • 旗舰品质,价格极低
  • 出色的编码和数学能力
  • 支持微调和缓存

缺点

  • 仅65K上下文
  • 无视觉功能
  • 函数调用可靠性有限

性能

输出速度~50 tok/s
速率限制3,000 RPM

多模态能力

图像输入图像输出音频输入音频输出

基准测试

MMLU
87.1%
SWE-bench Verified
50.0%
MATH
75.0%
HumanEval
89.0%

使用此模型的智能体

2

DeepSeek R1

Reasoning

深度推理、数学证明

官方定价

适用场景: 预算推理模型——当o3成本过高时,用于数学/逻辑管道的替代方案。

核心升级

  • 比o3便宜4倍($0.55 vs $2/百万输入)用于可比推理
  • AIME 2024: 79.8%——在数学基准上与o1竞争
  • 提示缓存:$0.14/百万——重复前缀节省75%
  • 开源推理模型——自托管实现无限使用
  • 无函数调用或视觉——纯推理;升级到V4 Pro以获取工具
输入价格
$0.550
per 1M tokens
输出价格
$2.19
per 1M tokens
缓存输入
$0.140
per 1M tokens
批量输入
per 1M tokens
上下文窗口: 66K
最大输出: 8,192 tokens
知识截止日期: 2024-07
视觉函数调用微调JSON 模式

优点

  • 比o3推理便宜4倍
  • 强大的数学和逻辑能力
  • 良好的提示缓存节省

缺点

  • 无函数调用
  • 无视觉或微调
  • 仅65K上下文

性能

输出速度~20 tok/s
速率限制2,000 RPM

多模态能力

图像输入图像输出音频输入音频输出

基准测试

AIME 2024
79.8%
MATH
97.3%
GPQA
71.5%

并排比较

模型层级输入输出上下文
DeepSeek V4 ProReasoning$1.32$1.981M
DeepSeek V4 FlashFlagship$0.220$0.6601M
DeepSeek V3Flagship$0.270$1.1066K
DeepSeek R1Reasoning$0.550$2.1966K