Voltar à Zona do DesenvolvedorPreços Oficiais Preços Oficiais Preços Oficiais Preços Oficiais
xAI Modelos
Explore todos os 4 modelos de xAI com preços detalhados, prós e contras e recomendações para desenvolvedores.
4
Modelos
$0.200
Menor Entrada
2M
Contexto Máximo
2
Níveis de Qualidade
Recomendações Rápidas
Melhor Custo-Benefício: Grok 4.1 Fast ($0.200/1M)
Melhor Qualidade: Grok 4.6
Grok 4.6
NOVOFlagshipCoding, math, reasoning
Quando usar: Strong pick for coding agents and reasoning-heavy workloads when you want frontier quality below $5/M input.
Destaques da Atualização
- ◆New xAI flagship at $2/$6 per 1M tokens — undercuts Grok 4.3's successors on capability-per-dollar
- ◆500K context, cached input at $0.50/M
- ◆Grok Build 0.1 coding stack ships alongside it in public beta
Preço de Entrada
$2.00
per 1M tokens
Preço de Saída
$6.00
per 1M tokens
Entrada em Cache
$0.500
per 1M tokens
Entrada em Lote
—
per 1M tokens
Janela de Contexto: 500K
Saída Máxima: 32,000 tokens
Corte de Conhecimento: 2026-01
VisãoChamada de FunçãoAjuste FinoModo JSON
Prós
- xAI's smartest model — frontier coding, knowledge work and STEM
- Configurable reasoning
- Fast variant available at 2x price
- Live in GitHub Copilot
Contras
- 500K context is below rivals' 1M
- No fine-tuning
Desempenho
Velocidade de saída—
Limite de taxa—
Multimodal
Entrada de imagemSaída de imagemEntrada de áudioSaída de áudio
Grok 4.3
FlagshipUso geral, capacidade máxima
Quando usar: Melhor modelo xAI para aplicações de uso geral que exigem acesso a conhecimento em tempo real.
Destaques da Atualização
- ◆Janela de contexto de 1M — aumento de 8x em relação aos 128K do Grok 3
- ◆Preço: $1,25/$2,50 — 60% mais barato que o Grok 3 ($3/$15)
- ◆Pesquisa em tempo real na web + X (Twitter) — acesso único a conhecimento ao vivo
- ◆Cache de contexto: $0,20/M — economia de 84% para prefixos repetidos
- ◆Saída máxima de 32K — 4x os 8K do Grok 3 para geração de formato longo
Preço de Entrada
$1.25
per 1M tokens
Preço de Saída
$2.50
per 1M tokens
Entrada em Cache
$0.200
per 1M tokens
Entrada em Lote
—
per 1M tokens
Janela de Contexto: 1M
Saída Máxima: 32,000 tokens
Corte de Conhecimento: 2025-06
VisãoChamada de FunçãoAjuste FinoModo JSON
Prós
- Janela de contexto de 1M a $1,25/M de entrada
- Modelo xAI mais inteligente
- Pesquisa em tempo real na web e X
Contras
- Sem API em lote
- Sem ajuste fino
- Ecossistema mais novo
Desempenho
Velocidade de saída~65 tok/s
Limite de taxa3,000 RPM
Multimodal
Entrada de imagemSaída de imagemEntrada de áudioSaída de áudio
Benchmarks
MMLU
87.5%
SWE-bench Verified
62.0%
GPQA
73.0%
Grok 4.1 Fast
Mid-tierCargas de trabalho de produção otimizadas para custo
Quando usar: Ideal para aplicações de produção sensíveis à latência e processamento de documentos longos com orçamento limitado.
Destaques da Atualização
- ◆Janela de contexto de 2M — a maior entre todos os modelos de médio porte
- ◆$0,20/M de entrada — 6x mais barato que o Grok 4.3 para tarefas de alto volume
- ◆Latência ultrabaixa — otimizado para tempos de resposta abaixo de 500ms
- ◆Saída máxima de 16K — 2x os 8K do Grok 3 para gerações mais longas
- ◆Cache de contexto: $0,05/M — economia de 75% para prefixos repetidos
Preço de Entrada
$0.200
per 1M tokens
Preço de Saída
$0.500
per 1M tokens
Entrada em Cache
$0.050
per 1M tokens
Entrada em Lote
—
per 1M tokens
Janela de Contexto: 2M
Saída Máxima: 16,000 tokens
Corte de Conhecimento: 2025-04
VisãoChamada de FunçãoAjuste FinoModo JSON
Prós
- Janela de contexto de 2M — a maior entre as de médio porte
- Tempos de resposta extremamente rápidos
- Uma das taxas mais baixas para APIs de fronteira
Contras
- Qualidade inferior à do Grok 4.3
- Sem API em lote
- Sem ajuste fino
Desempenho
Velocidade de saída~110 tok/s
Limite de taxa8,000 RPM
Multimodal
Entrada de imagemSaída de imagemEntrada de áudioSaída de áudio
Benchmarks
MMLU
83.0%
HumanEval
80.0%
Grok 3
FlagshipInformações em tempo real, análise
Quando usar: Quando dados em tempo real do X/Twitter ou conhecimento muito atual são essenciais.
Destaques da Atualização
- ◆Integração em tempo real com X/Twitter — conhecimento único de mídia social ao vivo
- ◆Corte de conhecimento: 2025-02 — um dos mais atuais disponíveis
- ◆Visão + chamada de funções — capacidade multimodal completa no lançamento
- ◆Sem cache ou API em lote — atualize para Grok 4.3 para suporte a cache
- ◆Contexto de 128K — substituído pelo 1M do Grok 4.3 para tarefas de documentos longos
Preço de Entrada
$3.00
per 1M tokens
Preço de Saída
$15.00
per 1M tokens
Entrada em Cache
—
per 1M tokens
Entrada em Lote
—
per 1M tokens
Janela de Contexto: 131K
Saída Máxima: 8,192 tokens
Corte de Conhecimento: 2025-02
VisãoChamada de FunçãoAjuste FinoModo JSON
Prós
- Corte de conhecimento muito recente
- Integração em tempo real com X/Twitter
- Visão + chamada de funções
Contras
- Caro ($3/$15)
- Sem cache ou lote
- Sem ajuste fino
Desempenho
Velocidade de saída~55 tok/s
Limite de taxa2,000 RPM
Multimodal
Entrada de imagemSaída de imagemEntrada de áudioSaída de áudio
Benchmarks
MMLU
85.0%
GPQA
68.0%
MATH
70.0%
Comparação Lado a Lado
| Modelo | Nível | Entrada | Saída | Contexto |
|---|---|---|---|---|
| Grok 4.6 | Flagship | $2.00 | $6.00 | 500K |
| Grok 4.3 | Flagship | $1.25 | $2.50 | 1M |
| Grok 4.1 Fast | Mid-tier | $0.200 | $0.500 | 2M |
| Grok 3 | Flagship | $3.00 | $15.00 | 131K |