DeepSeek Modelos
Explore todos os 4 modelos de DeepSeek com preços detalhados, prós e contras e recomendações para desenvolvedores.
Recomendações Rápidas
DeepSeek V4 Pro
ReasoningRaciocínio profundo, análise complexa
Quando usar: Melhor modelo de raciocínio econômico com capacidade massiva de saída para matemática, lógica e análise.
Destaques da Atualização
- ◆384K de saída máxima — a maior do mercado (3x os 128K do GPT-5.5)
- ◆Janela de contexto de 1M — aumento de 16x em relação aos 65K do DeepSeek R1
- ◆99% mais barato que o GPT-5.5 para raciocínio ($0,435 vs $5/M de entrada)
- ◆Entrada em cache: $0,003625/M — economia de 99,2% para prefixos repetidos
- ◆Modo de pensamento: raciocínio profundo ativável sem custo extra
Prós
- 384K de saída máxima — a maior disponível
- Janela de contexto de 1M
- 99% mais barato que o GPT-5.5 para raciocínio
Contras
- Sem suporte para visão
- Sem ajuste fino
- Modo de pensamento adiciona custo de token
Desempenho
Multimodal
Benchmarks
DeepSeek V4 Flash
FlagshipCodificação ultra-barata, tarefas gerais
Quando usar: Melhor para codificação de alto volume e tarefas gerais onde o custo é a principal preocupação.
Destaques da Atualização
- ◆LLM mais barato disponível: $0,14/M de entrada, $0,28/M de saída
- ◆1M de contexto + 384K de saída — mesma capacidade do V4 Pro por 1/3 do preço
- ◆Modo duplo: pensamento e não pensamento — alterne conforme a complexidade da tarefa
- ◆Entrada em cache: $0,0028/M — 98% de economia para prompts de sistema
- ◆Sem visão — apenas texto; use GPT-4.1 ou Gemini para necessidades multimodais
Prós
- LLM mais barato disponível a $0,14/M de entrada
- 1M de contexto + 384K de saída
- Suporta modos de pensamento e não pensamento
Contras
- Sem suporte para visão
- Qualidade inferior ao GPT-5.4 para tarefas complexas
- Sem ajuste fino
Desempenho
Multimodal
Benchmarks
DeepSeek V3
FlagshipCodificação, matemática, raciocínio
Quando usar: Melhor modelo principal de baixo custo para cargas de trabalho intensivas em codificação. 10x mais barato que GPT-4.1 para qualidade comparável.
Destaques da Atualização
- ◆10x mais barato que GPT-4.1 ($0,27 vs $2/M de entrada) para codificação comparável
- ◆Ajuste fino disponível — personalize para tarefas de codificação específicas do domínio
- ◆Cache de prompt: $0,07/M — 74% de economia para prompts de sistema repetidos
- ◆671B parâmetros MoE com 37B ativos — inteligência de alto nível a preço de orçamento
- ◆Contexto de 65K é pequeno em comparação com concorrentes de 1M — atualize para V4 para contexto longo
Prós
- Extremamente barato para qualidade de alto nível
- Excelente codificação e matemática
- Ajuste fino e cache disponíveis
Contras
- Apenas 65K de contexto
- Sem visão
- Confiabilidade limitada na chamada de funções
Desempenho
Multimodal
Benchmarks
DeepSeek R1
ReasoningRaciocínio profundo, provas matemáticas
Quando usar: Modelo de raciocínio econômico — use quando o custo do o3 for proibitivo para pipelines de matemática/lógica.
Destaques da Atualização
- ◆4x mais barato que o3 ($0,55 vs $2/M de entrada) para raciocínio comparável
- ◆AIME 2024: 79,8% — competitivo com o1 em benchmarks de matemática
- ◆Cache de prompts: $0,14/M — 75% de economia para prefixos repetidos
- ◆Modelo de raciocínio de código aberto — auto-hospede para uso ilimitado
- ◆Sem chamada de funções ou visão — raciocínio puro; atualize para V4 Pro para ferramentas
Prós
- 4x mais barato que o3 para raciocínio
- Forte em matemática e lógica
- Boas economias com cache de prompts
Contras
- Sem chamada de funções
- Sem visão ou ajuste fino
- Apenas 65K de contexto
Desempenho
Multimodal
Benchmarks
Comparação Lado a Lado
| Modelo | Nível | Entrada | Saída | Contexto |
|---|---|---|---|---|
| DeepSeek V4 Pro | Reasoning | $1.32 | $1.98 | 1M |
| DeepSeek V4 Flash | Flagship | $0.220 | $0.660 | 1M |
| DeepSeek V3 | Flagship | $0.270 | $1.10 | 66K |
| DeepSeek R1 | Reasoning | $0.550 | $2.19 | 66K |