Zurück zur Entwicklerzone

DeepSeek Modelle

Entdecken Sie alle 4 Modelle von DeepSeek mit detaillierten Preisen, Vor- und Nachteilen sowie Entwicklerempfehlungen.

4
Modelle
$0.220
Niedrigster Input
1M
Max. Kontext
2
Qualitätsstufen

Schnellempfehlungen

Bestes Preis-Leistungs-Verhältnis: DeepSeek V4 Flash ($0.220/1M)
Beste Qualität: DeepSeek V4 Flash
Am besten für logisches Denken: DeepSeek V4 Pro

DeepSeek V4 Pro

Reasoning

Tiefes Denken, komplexe Analyse

Offizielle Preise

Wann verwenden: Bestes preisgünstiges Reasoning-Modell mit massiver Ausgabekapazität für Mathematik, Logik und Analyse.

Upgrade-Highlights

  • 384K maximale Ausgabe — die größte auf dem Markt (3x GPT-5.5s 128K)
  • 1M Kontextfenster — 16-fache Steigerung gegenüber DeepSeek R1s 65K
  • 99% günstiger als GPT-5.5 für Reasoning ($0,435 vs $5/M Eingabe)
  • Zwischengespeicherte Eingabe: $0,003625/M — 99,2% Ersparnis bei wiederholten Präfixen
  • Denkmodus: umschaltbares tiefes Denken ohne zusätzliche Kosten
Input-Preis
$1.32
per 1M tokens
Output-Preis
$1.98
per 1M tokens
Cached Input
$0.022
per 1M tokens
Batch-Input
per 1M tokens
Kontextfenster: 1M
Max. Output: 384,000 tokens
Wissensstand: 2025-06
VisionFunktionsaufrufFeinabstimmungJSON-Modus

Vorteile

  • 384K maximale Ausgabe — die größte verfügbare
  • 1M Kontextfenster
  • 99% günstiger als GPT-5.5 für Reasoning

Nachteile

  • Keine Bildunterstützung
  • Kein Feintuning
  • Denkmodus erhöht Token-Kosten

Leistung

Ausgabegeschwindigkeit~30 tok/s
Rate-Limit2,000 RPM

Multimodal

BildeingabeBildausgabeAudioeingabeAudioausgabe

Benchmarks

MMLU
88.0%
AIME 2024
85.0%
SWE-bench Verified
71.0%
MATH
82.5%

DeepSeek V4 Flash

Flagship

Ultra-günstiges Codieren, allgemeine Aufgaben

Offizielle Preise

Wann verwenden: Am besten für hohes Codierungsvolumen und allgemeine Aufgaben, bei denen die Kosten im Vordergrund stehen.

Upgrade-Highlights

  • Günstigstes LLM verfügbar: 0,14 $/M Eingabe, 0,28 $/M Ausgabe
  • 1M Kontext + 384K Ausgabe — gleiche Kapazität wie V4 Pro zu 1/3 des Preises
  • Dual-Modus: Denken und Nicht-Denken — je nach Aufgabenkomplexität umschaltbar
  • Zwischengespeicherte Eingabe: 0,0028 $/M — 98% Einsparung bei System-Prompts
  • Keine Bildverarbeitung — nur Text; verwenden Sie GPT-4.1 oder Gemini für multimodale Anforderungen
Input-Preis
$0.220
per 1M tokens
Output-Preis
$0.660
per 1M tokens
Cached Input
$0.0028
per 1M tokens
Batch-Input
per 1M tokens
Kontextfenster: 1M
Max. Output: 384,000 tokens
Wissensstand: 2025-06
VisionFunktionsaufrufFeinabstimmungJSON-Modus

Vorteile

  • Günstigstes LLM verfügbar für 0,14 $/M Eingabe
  • 1M Kontext + 384K Ausgabe
  • Unterstützt sowohl Denk- als auch Nicht-Denk-Modi

Nachteile

  • Keine Bildunterstützung
  • Qualität unter GPT-5.4 für komplexe Aufgaben
  • Kein Feintuning

Leistung

Ausgabegeschwindigkeit~60 tok/s
Rate-Limit5,000 RPM

Multimodal

BildeingabeBildausgabeAudioeingabeAudioausgabe

Benchmarks

MMLU
84.5%
HumanEval
86.0%
SWE-bench Verified
55.0%

DeepSeek V3

Flagship

Codierung, Mathematik, logisches Denken

Offizielle Preise

Wann verwenden: Bestes Budget-Flaggschiff für codierungslastige Arbeitslasten. 10x günstiger als GPT-4.1 bei vergleichbarer Qualität.

Upgrade-Highlights

  • 10x günstiger als GPT-4.1 ($0,27 vs $2/M Eingabe) für vergleichbare Codierung
  • Feinabstimmung verfügbar — für domänenspezifische Codierungsaufgaben anpassbar
  • Prompt-Caching: $0,07/M — 74% Einsparungen bei wiederholten System-Prompts
  • 671B MoE-Parameter mit 37B aktiven — Flaggschiff-Intelligenz zum Budgetpreis
  • 65K Kontext ist klein im Vergleich zu 1M Mitbewerbern — Upgrade auf V4 für langen Kontext
Input-Preis
$0.270
per 1M tokens
Output-Preis
$1.10
per 1M tokens
Cached Input
$0.070
per 1M tokens
Batch-Input
per 1M tokens
Kontextfenster: 66K
Max. Output: 8,192 tokens
Wissensstand: 2024-07
VisionFunktionsaufrufFeinabstimmungJSON-Modus

Vorteile

  • Extrem günstig für Flaggschiff-Qualität
  • Hervorragende Codierung & Mathematik
  • Feinabstimmung + Caching verfügbar

Nachteile

  • Nur 65K Kontext
  • Keine Bildverarbeitung
  • Eingeschränkte Zuverlässigkeit bei Funktionsaufrufen

Leistung

Ausgabegeschwindigkeit~50 tok/s
Rate-Limit3,000 RPM

Multimodal

BildeingabeBildausgabeAudioeingabeAudioausgabe

Benchmarks

MMLU
87.1%
SWE-bench Verified
50.0%
MATH
75.0%
HumanEval
89.0%

Agenten die dieses Modell verwenden

2

DeepSeek R1

Reasoning

Tiefes Denken, mathematische Beweise

Offizielle Preise

Wann verwenden: Budget-Reasoning-Modell — verwenden Sie es, wenn die o3-Kosten für Mathematik-/Logik-Pipelines zu hoch sind.

Upgrade-Highlights

  • 4x günstiger als o3 ($0,55 vs $2/M Input) für vergleichbares Reasoning
  • AIME 2024: 79,8% — wettbewerbsfähig mit o1 bei Mathematik-Benchmarks
  • Prompt-Caching: $0,14/M — 75% Ersparnis bei wiederholten Präfixen
  • Open-Source-Reasoning-Modell — selbst hosten für unbegrenzte Nutzung
  • Kein Function Calling oder Vision — reines Reasoning; Upgrade auf V4 Pro für Tools
Input-Preis
$0.550
per 1M tokens
Output-Preis
$2.19
per 1M tokens
Cached Input
$0.140
per 1M tokens
Batch-Input
per 1M tokens
Kontextfenster: 66K
Max. Output: 8,192 tokens
Wissensstand: 2024-07
VisionFunktionsaufrufFeinabstimmungJSON-Modus

Vorteile

  • 4x günstiger als o3 für Reasoning
  • Starke Mathematik & Logik
  • Gute Prompt-Caching-Ersparnisse

Nachteile

  • Kein Function Calling
  • Keine Vision oder Feintuning
  • Nur 65K Kontext

Leistung

Ausgabegeschwindigkeit~20 tok/s
Rate-Limit2,000 RPM

Multimodal

BildeingabeBildausgabeAudioeingabeAudioausgabe

Benchmarks

AIME 2024
79.8%
MATH
97.3%
GPQA
71.5%

Nebeneinander-Vergleich

ModellStufeInputOutputKontext
DeepSeek V4 ProReasoning$1.32$1.981M
DeepSeek V4 FlashFlagship$0.220$0.6601M
DeepSeek V3Flagship$0.270$1.1066K
DeepSeek R1Reasoning$0.550$2.1966K