Retour à l'espace développeur

DeepSeek Modèles

Explorez les 4 modèles de DeepSeek avec des prix détaillés, avantages et inconvénients, et recommandations pour développeurs.

4
Modèles
$0.220
Entrée la moins chère
1M
Contexte max
2
Niveaux de qualité

Recommandations rapides

Meilleur rapport qualité-prix: DeepSeek V4 Flash ($0.220/1M)
Meilleure qualité: DeepSeek V4 Flash
Meilleur pour le raisonnement: DeepSeek V4 Pro

DeepSeek V4 Pro

Reasoning

Raisonnement approfondi, analyse complexe

Tarifs officiels

Quand l'utiliser: Meilleur modèle de raisonnement économique avec une capacité de sortie massive pour les mathématiques, la logique et l'analyse.

Points clés de la mise à niveau

  • 384K sortie max — la plus grande du marché (3x celle de GPT-5.5 à 128K)
  • Fenêtre de contexte de 1M — augmentation de 16x par rapport aux 65K de DeepSeek R1
  • 99% moins cher que GPT-5.5 pour le raisonnement (0,435 $ vs 5 $/M d'entrée)
  • Entrée en cache : 0,003625 $/M — 99,2% d'économies pour les préfixes répétés
  • Mode réflexion : raisonnement approfondi activable sans coût supplémentaire
Prix d'entrée
$1.32
per 1M tokens
Prix de sortie
$1.98
per 1M tokens
Entrée en cache
$0.022
per 1M tokens
Entrée batch
per 1M tokens
Fenêtre de contexte: 1M
Sortie max: 384,000 tokens
Date de coupure des connaissances: 2025-06
VisionAppel de fonctionAjustement finMode JSON

Avantages

  • 384K sortie max — la plus grande disponible
  • Fenêtre de contexte de 1M
  • 99% moins cher que GPT-5.5 pour le raisonnement

Inconvénients

  • Pas de support visuel
  • Pas de réglage fin
  • Le mode réflexion ajoute une surcharge de tokens

Performance

Vitesse de sortie~30 tok/s
Limite de débit2,000 RPM

Multimodal

Entrée imageSortie imageEntrée audioSortie audio

Benchmarks

MMLU
88.0%
AIME 2024
85.0%
SWE-bench Verified
71.0%
MATH
82.5%

DeepSeek V4 Flash

Flagship

Codage ultra-économique, tâches générales

Tarifs officiels

Quand l'utiliser: Idéal pour le codage à volume élevé et les tâches générales où le coût est la principale préoccupation.

Points clés de la mise à niveau

  • LLM le moins cher disponible : 0,14 $/M d'entrée, 0,28 $/M de sortie
  • Contexte de 1M + sortie de 384K — même capacité que V4 Pro à 1/3 du prix
  • Mode double : réflexion et non-réflexion — basculez selon la complexité de la tâche
  • Entrée en cache : 0,0028 $/M — 98 % d'économies pour les invites système
  • Pas de vision — texte uniquement ; utilisez GPT-4.1 ou Gemini pour les besoins multimodaux
Prix d'entrée
$0.220
per 1M tokens
Prix de sortie
$0.660
per 1M tokens
Entrée en cache
$0.0028
per 1M tokens
Entrée batch
per 1M tokens
Fenêtre de contexte: 1M
Sortie max: 384,000 tokens
Date de coupure des connaissances: 2025-06
VisionAppel de fonctionAjustement finMode JSON

Avantages

  • LLM le moins cher disponible à 0,14 $/M d'entrée
  • Contexte de 1M + sortie de 384K
  • Prend en charge les modes de réflexion et de non-réflexion

Inconvénients

  • Pas de support visuel
  • Qualité inférieure à GPT-5.4 pour les tâches complexes
  • Pas de réglage fin

Performance

Vitesse de sortie~60 tok/s
Limite de débit5,000 RPM

Multimodal

Entrée imageSortie imageEntrée audioSortie audio

Benchmarks

MMLU
84.5%
HumanEval
86.0%
SWE-bench Verified
55.0%

DeepSeek V3

Flagship

Codage, mathématiques, raisonnement

Tarifs officiels

Quand l'utiliser: Meilleur modèle phare économique pour les charges de travail intensives en codage. 10 fois moins cher que GPT-4.1 pour une qualité comparable.

Points clés de la mise à niveau

  • 10 fois moins cher que GPT-4.1 (0,27 $ contre 2 $/M d'entrée) pour un codage comparable
  • Fine-tuning disponible — personnalisez pour des tâches de codage spécifiques
  • Mise en cache des invites : 0,07 $/M — 74 % d'économies pour les invites système répétées
  • 671B paramètres MoE avec 37B actifs — intelligence phare à prix économique
  • 65K de contexte est petit face aux concurrents à 1M — passez à V4 pour un long contexte
Prix d'entrée
$0.270
per 1M tokens
Prix de sortie
$1.10
per 1M tokens
Entrée en cache
$0.070
per 1M tokens
Entrée batch
per 1M tokens
Fenêtre de contexte: 66K
Sortie max: 8,192 tokens
Date de coupure des connaissances: 2024-07
VisionAppel de fonctionAjustement finMode JSON

Avantages

  • Extrêmement économique pour une qualité phare
  • Excellent en codage et mathématiques
  • Fine-tuning et mise en cache disponibles

Inconvénients

  • Seulement 65K de contexte
  • Pas de vision
  • Fiabilité limitée des appels de fonction

Performance

Vitesse de sortie~50 tok/s
Limite de débit3,000 RPM

Multimodal

Entrée imageSortie imageEntrée audioSortie audio

Benchmarks

MMLU
87.1%
SWE-bench Verified
50.0%
MATH
75.0%
HumanEval
89.0%

Agents utilisant ce modèle

2

DeepSeek R1

Reasoning

Raisonnement approfondi, preuves mathématiques

Tarifs officiels

Quand l'utiliser: Modèle de raisonnement économique — à utiliser lorsque le coût de o3 est prohibitif pour les pipelines mathématiques/logiques.

Points clés de la mise à niveau

  • 4x moins cher que o3 (0,55 $ vs 2 $/M d'entrée) pour un raisonnement comparable
  • AIME 2024 : 79,8 % — compétitif avec o1 sur les benchmarks mathématiques
  • Cache de prompt : 0,14 $/M — 75 % d'économies pour les préfixes répétés
  • Modèle de raisonnement open-source — auto-hébergement pour une utilisation illimitée
  • Pas d'appel de fonction ni de vision — raisonnement pur ; passez à V4 Pro pour les outils
Prix d'entrée
$0.550
per 1M tokens
Prix de sortie
$2.19
per 1M tokens
Entrée en cache
$0.140
per 1M tokens
Entrée batch
per 1M tokens
Fenêtre de contexte: 66K
Sortie max: 8,192 tokens
Date de coupure des connaissances: 2024-07
VisionAppel de fonctionAjustement finMode JSON

Avantages

  • 4x moins cher que o3 pour le raisonnement
  • Forte capacité en mathématiques et logique
  • Bonnes économies de cache de prompt

Inconvénients

  • Pas d'appel de fonction
  • Pas de vision ni de fine-tuning
  • Seulement 65K de contexte

Performance

Vitesse de sortie~20 tok/s
Limite de débit2,000 RPM

Multimodal

Entrée imageSortie imageEntrée audioSortie audio

Benchmarks

AIME 2024
79.8%
MATH
97.3%
GPQA
71.5%

Comparaison côte à côte

ModèleNiveauEntréeSortieContexte
DeepSeek V4 ProReasoning$1.32$1.981M
DeepSeek V4 FlashFlagship$0.220$0.6601M
DeepSeek V3Flagship$0.270$1.1066K
DeepSeek R1Reasoning$0.550$2.1966K