Retour à l'espace développeur

xAI Modèles

Explorez les 4 modèles de xAI avec des prix détaillés, avantages et inconvénients, et recommandations pour développeurs.

4
Modèles
$0.200
Entrée la moins chère
2M
Contexte max
2
Niveaux de qualité

Recommandations rapides

Meilleur rapport qualité-prix: Grok 4.1 Fast ($0.200/1M)
Meilleure qualité: Grok 4.6

Grok 4.6

NOUVEAUFlagship

Coding, math, reasoning

Tarifs officiels

Quand l'utiliser: Strong pick for coding agents and reasoning-heavy workloads when you want frontier quality below $5/M input.

Points clés de la mise à niveau

  • New xAI flagship at $2/$6 per 1M tokens — undercuts Grok 4.3's successors on capability-per-dollar
  • 500K context, cached input at $0.50/M
  • Grok Build 0.1 coding stack ships alongside it in public beta
Prix d'entrée
$2.00
per 1M tokens
Prix de sortie
$6.00
per 1M tokens
Entrée en cache
$0.500
per 1M tokens
Entrée batch
per 1M tokens
Fenêtre de contexte: 500K
Sortie max: 32,000 tokens
Date de coupure des connaissances: 2026-01
VisionAppel de fonctionAjustement finMode JSON

Avantages

  • xAI's smartest model — frontier coding, knowledge work and STEM
  • Configurable reasoning
  • Fast variant available at 2x price
  • Live in GitHub Copilot

Inconvénients

  • 500K context is below rivals' 1M
  • No fine-tuning

Performance

Vitesse de sortie
Limite de débit

Multimodal

Entrée imageSortie imageEntrée audioSortie audio

Grok 4.3

Flagship

Usage général, capacité maximale

Tarifs officiels

Quand l'utiliser: Meilleur modèle xAI pour les applications générales nécessitant un accès aux connaissances en temps réel.

Points clés de la mise à niveau

  • Fenêtre de contexte de 1M — 8x plus que les 128K de Grok 3
  • Prix : 1,25 $/2,50 $ — 60 % moins cher que Grok 3 (3 $/15 $)
  • Recherche en temps réel sur le Web + X (Twitter) — accès unique aux connaissances en direct
  • Mise en cache de contexte : 0,20 $/M — 84 % d'économies pour les préfixes répétés
  • Sortie max de 32K — 4x les 8K de Grok 3 pour la génération longue
Prix d'entrée
$1.25
per 1M tokens
Prix de sortie
$2.50
per 1M tokens
Entrée en cache
$0.200
per 1M tokens
Entrée batch
per 1M tokens
Fenêtre de contexte: 1M
Sortie max: 32,000 tokens
Date de coupure des connaissances: 2025-06
VisionAppel de fonctionAjustement finMode JSON

Avantages

  • Fenêtre de contexte de 1M à 1,25 $/M d'entrée
  • Modèle xAI le plus intelligent
  • Recherche en temps réel sur le Web et X

Inconvénients

  • Pas d'API batch
  • Pas de fine-tuning
  • Écosystème plus récent

Performance

Vitesse de sortie~65 tok/s
Limite de débit3,000 RPM

Multimodal

Entrée imageSortie imageEntrée audioSortie audio

Benchmarks

MMLU
87.5%
SWE-bench Verified
62.0%
GPQA
73.0%

Grok 4.1 Fast

Mid-tier

Charges de production optimisées en coût

Tarifs officiels

Quand l'utiliser: Idéal pour les applications de production sensibles à la latence et le traitement de longs documents avec un budget limité.

Points clés de la mise à niveau

  • Fenêtre de contexte de 2M — la plus grande parmi tous les modèles de milieu de gamme
  • 0,20 $/M en entrée — 6 fois moins cher que Grok 4.3 pour les tâches à volume élevé
  • Latence ultra-faible — optimisé pour des temps de réponse inférieurs à 500 ms
  • Sortie max de 16K — 2 fois plus que les 8K de Grok 3 pour des générations plus longues
  • Mise en cache de contexte : 0,05 $/M — 75 % d'économies pour les préfixes répétés
Prix d'entrée
$0.200
per 1M tokens
Prix de sortie
$0.500
per 1M tokens
Entrée en cache
$0.050
per 1M tokens
Entrée batch
per 1M tokens
Fenêtre de contexte: 2M
Sortie max: 16,000 tokens
Date de coupure des connaissances: 2025-04
VisionAppel de fonctionAjustement finMode JSON

Avantages

  • Fenêtre de contexte de 2M — la plus grande parmi les modèles de milieu de gamme
  • Temps de réponse extrêmement rapides
  • L'un des taux les plus bas pour les API de pointe

Inconvénients

  • Qualité inférieure à Grok 4.3
  • Pas d'API batch
  • Pas de fine-tuning

Performance

Vitesse de sortie~110 tok/s
Limite de débit8,000 RPM

Multimodal

Entrée imageSortie imageEntrée audioSortie audio

Benchmarks

MMLU
83.0%
HumanEval
80.0%

Grok 3

Flagship

Informations en temps réel, analyse

Tarifs officiels

Quand l'utiliser: Lorsque les données en temps réel de X/Twitter ou des connaissances très actuelles sont essentielles.

Points clés de la mise à niveau

  • Intégration en temps réel X/Twitter — connaissance unique des réseaux sociaux en direct
  • Date de connaissance : 2025-02 — l'une des plus actuelles disponibles
  • Vision + appel de fonction — capacité multimodale complète dès le lancement
  • Pas d'API de mise en cache ou de traitement par lots — passez à Grok 4.3 pour la prise en charge de la mise en cache
  • Contexte 128K — remplacé par le 1M de Grok 4.3 pour les tâches de longs documents
Prix d'entrée
$3.00
per 1M tokens
Prix de sortie
$15.00
per 1M tokens
Entrée en cache
per 1M tokens
Entrée batch
per 1M tokens
Fenêtre de contexte: 131K
Sortie max: 8,192 tokens
Date de coupure des connaissances: 2025-02
VisionAppel de fonctionAjustement finMode JSON

Avantages

  • Date de connaissance très récente
  • Intégration en temps réel X/Twitter
  • Vision + appel de fonction

Inconvénients

  • Cher (3$/15$)
  • Pas de mise en cache ou de traitement par lots
  • Pas de réglage fin

Performance

Vitesse de sortie~55 tok/s
Limite de débit2,000 RPM

Multimodal

Entrée imageSortie imageEntrée audioSortie audio

Benchmarks

MMLU
85.0%
GPQA
68.0%
MATH
70.0%

Comparaison côte à côte

ModèleNiveauEntréeSortieContexte
Grok 4.6Flagship$2.00$6.00500K
Grok 4.3Flagship$1.25$2.501M
Grok 4.1 FastMid-tier$0.200$0.5002M
Grok 3Flagship$3.00$15.00131K