Zurück zur Entwicklerzone

xAI Modelle

Entdecken Sie alle 4 Modelle von xAI mit detaillierten Preisen, Vor- und Nachteilen sowie Entwicklerempfehlungen.

4
Modelle
$0.200
Niedrigster Input
2M
Max. Kontext
2
Qualitätsstufen

Schnellempfehlungen

Bestes Preis-Leistungs-Verhältnis: Grok 4.1 Fast ($0.200/1M)
Beste Qualität: Grok 4.6

Grok 4.6

NEUFlagship

Coding, math, reasoning

Offizielle Preise

Wann verwenden: Strong pick for coding agents and reasoning-heavy workloads when you want frontier quality below $5/M input.

Upgrade-Highlights

  • New xAI flagship at $2/$6 per 1M tokens — undercuts Grok 4.3's successors on capability-per-dollar
  • 500K context, cached input at $0.50/M
  • Grok Build 0.1 coding stack ships alongside it in public beta
Input-Preis
$2.00
per 1M tokens
Output-Preis
$6.00
per 1M tokens
Cached Input
$0.500
per 1M tokens
Batch-Input
per 1M tokens
Kontextfenster: 500K
Max. Output: 32,000 tokens
Wissensstand: 2026-01
VisionFunktionsaufrufFeinabstimmungJSON-Modus

Vorteile

  • xAI's smartest model — frontier coding, knowledge work and STEM
  • Configurable reasoning
  • Fast variant available at 2x price
  • Live in GitHub Copilot

Nachteile

  • 500K context is below rivals' 1M
  • No fine-tuning

Leistung

Ausgabegeschwindigkeit
Rate-Limit

Multimodal

BildeingabeBildausgabeAudioeingabeAudioausgabe

Grok 4.3

Flagship

Allzweck, maximale Leistungsfähigkeit

Offizielle Preise

Wann verwenden: Bestes xAI-Modell für Allzweckanwendungen, die Echtzeit-Wissenszugriff erfordern.

Upgrade-Highlights

  • 1M-Kontextfenster — 8-fache Steigerung gegenüber Grok 3s 128K
  • Preis: 1,25 $/2,50 $ — 60 % günstiger als Grok 3 (3 $/15 $)
  • Echtzeit-Web + X (Twitter)-Suche — einzigartiger Live-Wissenszugriff
  • Kontext-Caching: 0,20 $/M — 84 % Ersparnis für wiederholte Präfixe
  • 32K maximale Ausgabe — 4-fache von Grok 3s 8K für Langformgenerierung
Input-Preis
$1.25
per 1M tokens
Output-Preis
$2.50
per 1M tokens
Cached Input
$0.200
per 1M tokens
Batch-Input
per 1M tokens
Kontextfenster: 1M
Max. Output: 32,000 tokens
Wissensstand: 2025-06
VisionFunktionsaufrufFeinabstimmungJSON-Modus

Vorteile

  • 1M-Kontextfenster für 1,25 $/M Eingabe
  • Intelligentestes xAI-Modell
  • Echtzeit-Web- und X-Suche

Nachteile

  • Keine Batch-API
  • Kein Feintuning
  • Neueres Ökosystem

Leistung

Ausgabegeschwindigkeit~65 tok/s
Rate-Limit3,000 RPM

Multimodal

BildeingabeBildausgabeAudioeingabeAudioausgabe

Benchmarks

MMLU
87.5%
SWE-bench Verified
62.0%
GPQA
73.0%

Grok 4.1 Fast

Mid-tier

Kostenoptimierte Produktionsworkloads

Offizielle Preise

Wann verwenden: Am besten geeignet für latenzempfindliche Produktionsanwendungen und die Verarbeitung langer Dokumente mit begrenztem Budget.

Upgrade-Highlights

  • 2M-Kontextfenster — das größte unter allen Mid-Tier-Modellen
  • $0,20/M Eingabe — 6x günstiger als Grok 4.3 für Aufgaben mit hohem Volumen
  • Ultra-niedrige Latenz — optimiert für Antwortzeiten unter 500ms
  • 16K maximale Ausgabe — 2x Grok 3s 8K für längere Generierungen
  • Kontext-Caching: $0,05/M — 75% Einsparungen bei wiederholten Präfixen
Input-Preis
$0.200
per 1M tokens
Output-Preis
$0.500
per 1M tokens
Cached Input
$0.050
per 1M tokens
Batch-Input
per 1M tokens
Kontextfenster: 2M
Max. Output: 16,000 tokens
Wissensstand: 2025-04
VisionFunktionsaufrufFeinabstimmungJSON-Modus

Vorteile

  • 2M-Kontextfenster — das größte unter den Mid-Tier-Modellen
  • Extrem schnelle Antwortzeiten
  • Einer der niedrigsten Tarife für Frontier-APIs

Nachteile

  • Geringere Qualität als Grok 4.3
  • Keine Batch-API
  • Kein Fine-Tuning

Leistung

Ausgabegeschwindigkeit~110 tok/s
Rate-Limit8,000 RPM

Multimodal

BildeingabeBildausgabeAudioeingabeAudioausgabe

Benchmarks

MMLU
83.0%
HumanEval
80.0%

Grok 3

Flagship

Echtzeitinformationen, Analyse

Offizielle Preise

Wann verwenden: Wenn Echtzeitdaten von X/Twitter oder sehr aktuelles Wissen unerlässlich sind.

Upgrade-Highlights

  • Echtzeit-Integration von X/Twitter — einzigartiges Live-Social-Media-Wissen
  • Wissensstand: 2025-02 — einer der aktuellsten verfügbaren
  • Vision + Funktionsaufruf — volle multimodale Fähigkeit beim Start
  • Kein Caching oder Batch-API — Upgrade auf Grok 4.3 für Caching-Unterstützung
  • 128K Kontext — durch 1M von Grok 4.3 für Langdokumentaufgaben ersetzt
Input-Preis
$3.00
per 1M tokens
Output-Preis
$15.00
per 1M tokens
Cached Input
per 1M tokens
Batch-Input
per 1M tokens
Kontextfenster: 131K
Max. Output: 8,192 tokens
Wissensstand: 2025-02
VisionFunktionsaufrufFeinabstimmungJSON-Modus

Vorteile

  • Sehr aktueller Wissensstand
  • Echtzeit-Integration von X/Twitter
  • Vision + Funktionsaufruf

Nachteile

  • Teuer ($3/$15)
  • Kein Caching oder Batch
  • Kein Feintuning

Leistung

Ausgabegeschwindigkeit~55 tok/s
Rate-Limit2,000 RPM

Multimodal

BildeingabeBildausgabeAudioeingabeAudioausgabe

Benchmarks

MMLU
85.0%
GPQA
68.0%
MATH
70.0%

Nebeneinander-Vergleich

ModellStufeInputOutputKontext
Grok 4.6Flagship$2.00$6.00500K
Grok 4.3Flagship$1.25$2.501M
Grok 4.1 FastMid-tier$0.200$0.5002M
Grok 3Flagship$3.00$15.00131K