Voltar à Zona do Desenvolvedor

xAI Modelos

Explore todos os 4 modelos de xAI com preços detalhados, prós e contras e recomendações para desenvolvedores.

4
Modelos
$0.200
Menor Entrada
2M
Contexto Máximo
2
Níveis de Qualidade

Recomendações Rápidas

Melhor Custo-Benefício: Grok 4.1 Fast ($0.200/1M)
Melhor Qualidade: Grok 4.6

Grok 4.6

NOVOFlagship

Coding, math, reasoning

Preços Oficiais

Quando usar: Strong pick for coding agents and reasoning-heavy workloads when you want frontier quality below $5/M input.

Destaques da Atualização

  • New xAI flagship at $2/$6 per 1M tokens — undercuts Grok 4.3's successors on capability-per-dollar
  • 500K context, cached input at $0.50/M
  • Grok Build 0.1 coding stack ships alongside it in public beta
Preço de Entrada
$2.00
per 1M tokens
Preço de Saída
$6.00
per 1M tokens
Entrada em Cache
$0.500
per 1M tokens
Entrada em Lote
per 1M tokens
Janela de Contexto: 500K
Saída Máxima: 32,000 tokens
Corte de Conhecimento: 2026-01
VisãoChamada de FunçãoAjuste FinoModo JSON

Prós

  • xAI's smartest model — frontier coding, knowledge work and STEM
  • Configurable reasoning
  • Fast variant available at 2x price
  • Live in GitHub Copilot

Contras

  • 500K context is below rivals' 1M
  • No fine-tuning

Desempenho

Velocidade de saída
Limite de taxa

Multimodal

Entrada de imagemSaída de imagemEntrada de áudioSaída de áudio

Grok 4.3

Flagship

Uso geral, capacidade máxima

Preços Oficiais

Quando usar: Melhor modelo xAI para aplicações de uso geral que exigem acesso a conhecimento em tempo real.

Destaques da Atualização

  • Janela de contexto de 1M — aumento de 8x em relação aos 128K do Grok 3
  • Preço: $1,25/$2,50 — 60% mais barato que o Grok 3 ($3/$15)
  • Pesquisa em tempo real na web + X (Twitter) — acesso único a conhecimento ao vivo
  • Cache de contexto: $0,20/M — economia de 84% para prefixos repetidos
  • Saída máxima de 32K — 4x os 8K do Grok 3 para geração de formato longo
Preço de Entrada
$1.25
per 1M tokens
Preço de Saída
$2.50
per 1M tokens
Entrada em Cache
$0.200
per 1M tokens
Entrada em Lote
per 1M tokens
Janela de Contexto: 1M
Saída Máxima: 32,000 tokens
Corte de Conhecimento: 2025-06
VisãoChamada de FunçãoAjuste FinoModo JSON

Prós

  • Janela de contexto de 1M a $1,25/M de entrada
  • Modelo xAI mais inteligente
  • Pesquisa em tempo real na web e X

Contras

  • Sem API em lote
  • Sem ajuste fino
  • Ecossistema mais novo

Desempenho

Velocidade de saída~65 tok/s
Limite de taxa3,000 RPM

Multimodal

Entrada de imagemSaída de imagemEntrada de áudioSaída de áudio

Benchmarks

MMLU
87.5%
SWE-bench Verified
62.0%
GPQA
73.0%

Grok 4.1 Fast

Mid-tier

Cargas de trabalho de produção otimizadas para custo

Preços Oficiais

Quando usar: Ideal para aplicações de produção sensíveis à latência e processamento de documentos longos com orçamento limitado.

Destaques da Atualização

  • Janela de contexto de 2M — a maior entre todos os modelos de médio porte
  • $0,20/M de entrada — 6x mais barato que o Grok 4.3 para tarefas de alto volume
  • Latência ultrabaixa — otimizado para tempos de resposta abaixo de 500ms
  • Saída máxima de 16K — 2x os 8K do Grok 3 para gerações mais longas
  • Cache de contexto: $0,05/M — economia de 75% para prefixos repetidos
Preço de Entrada
$0.200
per 1M tokens
Preço de Saída
$0.500
per 1M tokens
Entrada em Cache
$0.050
per 1M tokens
Entrada em Lote
per 1M tokens
Janela de Contexto: 2M
Saída Máxima: 16,000 tokens
Corte de Conhecimento: 2025-04
VisãoChamada de FunçãoAjuste FinoModo JSON

Prós

  • Janela de contexto de 2M — a maior entre as de médio porte
  • Tempos de resposta extremamente rápidos
  • Uma das taxas mais baixas para APIs de fronteira

Contras

  • Qualidade inferior à do Grok 4.3
  • Sem API em lote
  • Sem ajuste fino

Desempenho

Velocidade de saída~110 tok/s
Limite de taxa8,000 RPM

Multimodal

Entrada de imagemSaída de imagemEntrada de áudioSaída de áudio

Benchmarks

MMLU
83.0%
HumanEval
80.0%

Grok 3

Flagship

Informações em tempo real, análise

Preços Oficiais

Quando usar: Quando dados em tempo real do X/Twitter ou conhecimento muito atual são essenciais.

Destaques da Atualização

  • Integração em tempo real com X/Twitter — conhecimento único de mídia social ao vivo
  • Corte de conhecimento: 2025-02 — um dos mais atuais disponíveis
  • Visão + chamada de funções — capacidade multimodal completa no lançamento
  • Sem cache ou API em lote — atualize para Grok 4.3 para suporte a cache
  • Contexto de 128K — substituído pelo 1M do Grok 4.3 para tarefas de documentos longos
Preço de Entrada
$3.00
per 1M tokens
Preço de Saída
$15.00
per 1M tokens
Entrada em Cache
per 1M tokens
Entrada em Lote
per 1M tokens
Janela de Contexto: 131K
Saída Máxima: 8,192 tokens
Corte de Conhecimento: 2025-02
VisãoChamada de FunçãoAjuste FinoModo JSON

Prós

  • Corte de conhecimento muito recente
  • Integração em tempo real com X/Twitter
  • Visão + chamada de funções

Contras

  • Caro ($3/$15)
  • Sem cache ou lote
  • Sem ajuste fino

Desempenho

Velocidade de saída~55 tok/s
Limite de taxa2,000 RPM

Multimodal

Entrada de imagemSaída de imagemEntrada de áudioSaída de áudio

Benchmarks

MMLU
85.0%
GPQA
68.0%
MATH
70.0%

Comparação Lado a Lado

ModeloNívelEntradaSaídaContexto
Grok 4.6Flagship$2.00$6.00500K
Grok 4.3Flagship$1.25$2.501M
Grok 4.1 FastMid-tier$0.200$0.5002M
Grok 3Flagship$3.00$15.00131K