Voltar à Zona do Desenvolvedor

DeepSeek Modelos

Explore todos os 4 modelos de DeepSeek com preços detalhados, prós e contras e recomendações para desenvolvedores.

4
Modelos
$0.220
Menor Entrada
1M
Contexto Máximo
2
Níveis de Qualidade

Recomendações Rápidas

Melhor Custo-Benefício: DeepSeek V4 Flash ($0.220/1M)
Melhor Qualidade: DeepSeek V4 Flash
Melhor para Raciocínio: DeepSeek V4 Pro

DeepSeek V4 Pro

Reasoning

Raciocínio profundo, análise complexa

Preços Oficiais

Quando usar: Melhor modelo de raciocínio econômico com capacidade massiva de saída para matemática, lógica e análise.

Destaques da Atualização

  • 384K de saída máxima — a maior do mercado (3x os 128K do GPT-5.5)
  • Janela de contexto de 1M — aumento de 16x em relação aos 65K do DeepSeek R1
  • 99% mais barato que o GPT-5.5 para raciocínio ($0,435 vs $5/M de entrada)
  • Entrada em cache: $0,003625/M — economia de 99,2% para prefixos repetidos
  • Modo de pensamento: raciocínio profundo ativável sem custo extra
Preço de Entrada
$1.32
per 1M tokens
Preço de Saída
$1.98
per 1M tokens
Entrada em Cache
$0.022
per 1M tokens
Entrada em Lote
per 1M tokens
Janela de Contexto: 1M
Saída Máxima: 384,000 tokens
Corte de Conhecimento: 2025-06
VisãoChamada de FunçãoAjuste FinoModo JSON

Prós

  • 384K de saída máxima — a maior disponível
  • Janela de contexto de 1M
  • 99% mais barato que o GPT-5.5 para raciocínio

Contras

  • Sem suporte para visão
  • Sem ajuste fino
  • Modo de pensamento adiciona custo de token

Desempenho

Velocidade de saída~30 tok/s
Limite de taxa2,000 RPM

Multimodal

Entrada de imagemSaída de imagemEntrada de áudioSaída de áudio

Benchmarks

MMLU
88.0%
AIME 2024
85.0%
SWE-bench Verified
71.0%
MATH
82.5%

DeepSeek V4 Flash

Flagship

Codificação ultra-barata, tarefas gerais

Preços Oficiais

Quando usar: Melhor para codificação de alto volume e tarefas gerais onde o custo é a principal preocupação.

Destaques da Atualização

  • LLM mais barato disponível: $0,14/M de entrada, $0,28/M de saída
  • 1M de contexto + 384K de saída — mesma capacidade do V4 Pro por 1/3 do preço
  • Modo duplo: pensamento e não pensamento — alterne conforme a complexidade da tarefa
  • Entrada em cache: $0,0028/M — 98% de economia para prompts de sistema
  • Sem visão — apenas texto; use GPT-4.1 ou Gemini para necessidades multimodais
Preço de Entrada
$0.220
per 1M tokens
Preço de Saída
$0.660
per 1M tokens
Entrada em Cache
$0.0028
per 1M tokens
Entrada em Lote
per 1M tokens
Janela de Contexto: 1M
Saída Máxima: 384,000 tokens
Corte de Conhecimento: 2025-06
VisãoChamada de FunçãoAjuste FinoModo JSON

Prós

  • LLM mais barato disponível a $0,14/M de entrada
  • 1M de contexto + 384K de saída
  • Suporta modos de pensamento e não pensamento

Contras

  • Sem suporte para visão
  • Qualidade inferior ao GPT-5.4 para tarefas complexas
  • Sem ajuste fino

Desempenho

Velocidade de saída~60 tok/s
Limite de taxa5,000 RPM

Multimodal

Entrada de imagemSaída de imagemEntrada de áudioSaída de áudio

Benchmarks

MMLU
84.5%
HumanEval
86.0%
SWE-bench Verified
55.0%

DeepSeek V3

Flagship

Codificação, matemática, raciocínio

Preços Oficiais

Quando usar: Melhor modelo principal de baixo custo para cargas de trabalho intensivas em codificação. 10x mais barato que GPT-4.1 para qualidade comparável.

Destaques da Atualização

  • 10x mais barato que GPT-4.1 ($0,27 vs $2/M de entrada) para codificação comparável
  • Ajuste fino disponível — personalize para tarefas de codificação específicas do domínio
  • Cache de prompt: $0,07/M — 74% de economia para prompts de sistema repetidos
  • 671B parâmetros MoE com 37B ativos — inteligência de alto nível a preço de orçamento
  • Contexto de 65K é pequeno em comparação com concorrentes de 1M — atualize para V4 para contexto longo
Preço de Entrada
$0.270
per 1M tokens
Preço de Saída
$1.10
per 1M tokens
Entrada em Cache
$0.070
per 1M tokens
Entrada em Lote
per 1M tokens
Janela de Contexto: 66K
Saída Máxima: 8,192 tokens
Corte de Conhecimento: 2024-07
VisãoChamada de FunçãoAjuste FinoModo JSON

Prós

  • Extremamente barato para qualidade de alto nível
  • Excelente codificação e matemática
  • Ajuste fino e cache disponíveis

Contras

  • Apenas 65K de contexto
  • Sem visão
  • Confiabilidade limitada na chamada de funções

Desempenho

Velocidade de saída~50 tok/s
Limite de taxa3,000 RPM

Multimodal

Entrada de imagemSaída de imagemEntrada de áudioSaída de áudio

Benchmarks

MMLU
87.1%
SWE-bench Verified
50.0%
MATH
75.0%
HumanEval
89.0%

Agentes que usam este modelo

2

DeepSeek R1

Reasoning

Raciocínio profundo, provas matemáticas

Preços Oficiais

Quando usar: Modelo de raciocínio econômico — use quando o custo do o3 for proibitivo para pipelines de matemática/lógica.

Destaques da Atualização

  • 4x mais barato que o3 ($0,55 vs $2/M de entrada) para raciocínio comparável
  • AIME 2024: 79,8% — competitivo com o1 em benchmarks de matemática
  • Cache de prompts: $0,14/M — 75% de economia para prefixos repetidos
  • Modelo de raciocínio de código aberto — auto-hospede para uso ilimitado
  • Sem chamada de funções ou visão — raciocínio puro; atualize para V4 Pro para ferramentas
Preço de Entrada
$0.550
per 1M tokens
Preço de Saída
$2.19
per 1M tokens
Entrada em Cache
$0.140
per 1M tokens
Entrada em Lote
per 1M tokens
Janela de Contexto: 66K
Saída Máxima: 8,192 tokens
Corte de Conhecimento: 2024-07
VisãoChamada de FunçãoAjuste FinoModo JSON

Prós

  • 4x mais barato que o3 para raciocínio
  • Forte em matemática e lógica
  • Boas economias com cache de prompts

Contras

  • Sem chamada de funções
  • Sem visão ou ajuste fino
  • Apenas 65K de contexto

Desempenho

Velocidade de saída~20 tok/s
Limite de taxa2,000 RPM

Multimodal

Entrada de imagemSaída de imagemEntrada de áudioSaída de áudio

Benchmarks

AIME 2024
79.8%
MATH
97.3%
GPQA
71.5%

Comparação Lado a Lado

ModeloNívelEntradaSaídaContexto
DeepSeek V4 ProReasoning$1.32$1.981M
DeepSeek V4 FlashFlagship$0.220$0.6601M
DeepSeek V3Flagship$0.270$1.1066K
DeepSeek R1Reasoning$0.550$2.1966K