Zurück zur EntwicklerzoneOffizielle Preise Offizielle Preise Offizielle Preise Offizielle Preise
xAI Modelle
Entdecken Sie alle 4 Modelle von xAI mit detaillierten Preisen, Vor- und Nachteilen sowie Entwicklerempfehlungen.
4
Modelle
$0.200
Niedrigster Input
2M
Max. Kontext
2
Qualitätsstufen
Schnellempfehlungen
Bestes Preis-Leistungs-Verhältnis: Grok 4.1 Fast ($0.200/1M)
Beste Qualität: Grok 4.6
Grok 4.6
NEUFlagshipCoding, math, reasoning
Wann verwenden: Strong pick for coding agents and reasoning-heavy workloads when you want frontier quality below $5/M input.
Upgrade-Highlights
- ◆New xAI flagship at $2/$6 per 1M tokens — undercuts Grok 4.3's successors on capability-per-dollar
- ◆500K context, cached input at $0.50/M
- ◆Grok Build 0.1 coding stack ships alongside it in public beta
Input-Preis
$2.00
per 1M tokens
Output-Preis
$6.00
per 1M tokens
Cached Input
$0.500
per 1M tokens
Batch-Input
—
per 1M tokens
Kontextfenster: 500K
Max. Output: 32,000 tokens
Wissensstand: 2026-01
VisionFunktionsaufrufFeinabstimmungJSON-Modus
Vorteile
- xAI's smartest model — frontier coding, knowledge work and STEM
- Configurable reasoning
- Fast variant available at 2x price
- Live in GitHub Copilot
Nachteile
- 500K context is below rivals' 1M
- No fine-tuning
Leistung
Ausgabegeschwindigkeit—
Rate-Limit—
Multimodal
BildeingabeBildausgabeAudioeingabeAudioausgabe
Grok 4.3
FlagshipAllzweck, maximale Leistungsfähigkeit
Wann verwenden: Bestes xAI-Modell für Allzweckanwendungen, die Echtzeit-Wissenszugriff erfordern.
Upgrade-Highlights
- ◆1M-Kontextfenster — 8-fache Steigerung gegenüber Grok 3s 128K
- ◆Preis: 1,25 $/2,50 $ — 60 % günstiger als Grok 3 (3 $/15 $)
- ◆Echtzeit-Web + X (Twitter)-Suche — einzigartiger Live-Wissenszugriff
- ◆Kontext-Caching: 0,20 $/M — 84 % Ersparnis für wiederholte Präfixe
- ◆32K maximale Ausgabe — 4-fache von Grok 3s 8K für Langformgenerierung
Input-Preis
$1.25
per 1M tokens
Output-Preis
$2.50
per 1M tokens
Cached Input
$0.200
per 1M tokens
Batch-Input
—
per 1M tokens
Kontextfenster: 1M
Max. Output: 32,000 tokens
Wissensstand: 2025-06
VisionFunktionsaufrufFeinabstimmungJSON-Modus
Vorteile
- 1M-Kontextfenster für 1,25 $/M Eingabe
- Intelligentestes xAI-Modell
- Echtzeit-Web- und X-Suche
Nachteile
- Keine Batch-API
- Kein Feintuning
- Neueres Ökosystem
Leistung
Ausgabegeschwindigkeit~65 tok/s
Rate-Limit3,000 RPM
Multimodal
BildeingabeBildausgabeAudioeingabeAudioausgabe
Benchmarks
MMLU
87.5%
SWE-bench Verified
62.0%
GPQA
73.0%
Grok 4.1 Fast
Mid-tierKostenoptimierte Produktionsworkloads
Wann verwenden: Am besten geeignet für latenzempfindliche Produktionsanwendungen und die Verarbeitung langer Dokumente mit begrenztem Budget.
Upgrade-Highlights
- ◆2M-Kontextfenster — das größte unter allen Mid-Tier-Modellen
- ◆$0,20/M Eingabe — 6x günstiger als Grok 4.3 für Aufgaben mit hohem Volumen
- ◆Ultra-niedrige Latenz — optimiert für Antwortzeiten unter 500ms
- ◆16K maximale Ausgabe — 2x Grok 3s 8K für längere Generierungen
- ◆Kontext-Caching: $0,05/M — 75% Einsparungen bei wiederholten Präfixen
Input-Preis
$0.200
per 1M tokens
Output-Preis
$0.500
per 1M tokens
Cached Input
$0.050
per 1M tokens
Batch-Input
—
per 1M tokens
Kontextfenster: 2M
Max. Output: 16,000 tokens
Wissensstand: 2025-04
VisionFunktionsaufrufFeinabstimmungJSON-Modus
Vorteile
- 2M-Kontextfenster — das größte unter den Mid-Tier-Modellen
- Extrem schnelle Antwortzeiten
- Einer der niedrigsten Tarife für Frontier-APIs
Nachteile
- Geringere Qualität als Grok 4.3
- Keine Batch-API
- Kein Fine-Tuning
Leistung
Ausgabegeschwindigkeit~110 tok/s
Rate-Limit8,000 RPM
Multimodal
BildeingabeBildausgabeAudioeingabeAudioausgabe
Benchmarks
MMLU
83.0%
HumanEval
80.0%
Grok 3
FlagshipEchtzeitinformationen, Analyse
Wann verwenden: Wenn Echtzeitdaten von X/Twitter oder sehr aktuelles Wissen unerlässlich sind.
Upgrade-Highlights
- ◆Echtzeit-Integration von X/Twitter — einzigartiges Live-Social-Media-Wissen
- ◆Wissensstand: 2025-02 — einer der aktuellsten verfügbaren
- ◆Vision + Funktionsaufruf — volle multimodale Fähigkeit beim Start
- ◆Kein Caching oder Batch-API — Upgrade auf Grok 4.3 für Caching-Unterstützung
- ◆128K Kontext — durch 1M von Grok 4.3 für Langdokumentaufgaben ersetzt
Input-Preis
$3.00
per 1M tokens
Output-Preis
$15.00
per 1M tokens
Cached Input
—
per 1M tokens
Batch-Input
—
per 1M tokens
Kontextfenster: 131K
Max. Output: 8,192 tokens
Wissensstand: 2025-02
VisionFunktionsaufrufFeinabstimmungJSON-Modus
Vorteile
- Sehr aktueller Wissensstand
- Echtzeit-Integration von X/Twitter
- Vision + Funktionsaufruf
Nachteile
- Teuer ($3/$15)
- Kein Caching oder Batch
- Kein Feintuning
Leistung
Ausgabegeschwindigkeit~55 tok/s
Rate-Limit2,000 RPM
Multimodal
BildeingabeBildausgabeAudioeingabeAudioausgabe
Benchmarks
MMLU
85.0%
GPQA
68.0%
MATH
70.0%
Nebeneinander-Vergleich
| Modell | Stufe | Input | Output | Kontext |
|---|---|---|---|---|
| Grok 4.6 | Flagship | $2.00 | $6.00 | 500K |
| Grok 4.3 | Flagship | $1.25 | $2.50 | 1M |
| Grok 4.1 Fast | Mid-tier | $0.200 | $0.500 | 2M |
| Grok 3 | Flagship | $3.00 | $15.00 | 131K |