Voltar à Zona do DesenvolvedorPreços Oficiais Preços Oficiais
Meta Modelos
Explore todos os 2 modelos de Meta com preços detalhados, prós e contras e recomendações para desenvolvedores.
2
Modelos
$0.100
Menor Entrada
10M
Contexto Máximo
2
Níveis de Qualidade
Recomendações Rápidas
Melhor Custo-Benefício: Llama 4 Scout ($0.100/1M)
Melhor Qualidade: Llama 4 Maverick
Llama 4 Maverick
FlagshipCódigo aberto, multimodal
Quando usar: Para equipes que desejam controle de código aberto ou auto-hospedagem com necessidades multimodais.
Destaques da Atualização
- ◆Código aberto — auto-hospede gratuitamente, controle total dos pesos do modelo
- ◆Janela de contexto de 1M — primeiro modelo de código aberto com essa capacidade
- ◆Multimodal (texto + visão) + ajustável — combinação única
- ◆17B parâmetros ativos (109B total) — arquitetura MoE para eficiência
- ◆Saída máxima de 4K é limitante — use para tarefas com muita entrada e pouca saída
Preço de Entrada
$0.200
per 1M tokens
Preço de Saída
$0.600
per 1M tokens
Entrada em Cache
—
per 1M tokens
Entrada em Lote
—
per 1M tokens
Janela de Contexto: 1M
Saída Máxima: 4,096 tokens
Corte de Conhecimento: 2024-08
VisãoChamada de FunçãoAjuste FinoModo JSONNível Gratuito
Prós
- Código aberto — pode auto-hospedar gratuitamente
- Janela de contexto de 1M
- Multimodal + ajustável
Contras
- Apenas 4K de saída máxima
- Sem modo JSON
- Preço hospedado via terceiros (Together AI)
Desempenho
Velocidade de saída~80 tok/s
Limite de taxa—
Multimodal
Entrada de imagemSaída de imagemEntrada de áudioSaída de áudio
Benchmarks
MMLU
84.5%
HumanEval
83.0%
SWE-bench Verified
44.2%
Llama 4 Scout
Mid-tierCódigo aberto, contexto longo
Quando usar: Inigualável para processar documentos muito longos. Melhor para RAG com janelas de contexto massivas.
Destaques da Atualização
- ◆Contexto de 10 milhões de tokens — 10x maior que qualquer outro modelo disponível
- ◆Código aberto + ajustável — auto-hospedagem para uso ilimitado
- ◆$0,10/M de entrada — modelo mais barato por token no mercado
- ◆17B parâmetros ativos (109B total) — mesmo MoE eficiente que o Maverick
- ◆4K de saída máxima — projetado para recuperação/análise, não para geração longa
Preço de Entrada
$0.100
per 1M tokens
Preço de Saída
$0.300
per 1M tokens
Entrada em Cache
—
per 1M tokens
Entrada em Lote
—
per 1M tokens
Janela de Contexto: 10M
Saída Máxima: 4,096 tokens
Corte de Conhecimento: 2024-08
VisãoChamada de FunçãoAjuste FinoModo JSONNível Gratuito
Prós
- Contexto de 10 milhões de tokens — o maior disponível
- Modelo mais barato por token
- Código aberto + ajustável
Contras
- Apenas 4K de saída máxima
- Sem modo JSON
- Qualidade inferior aos carros-chefe proprietários
Desempenho
Velocidade de saída~90 tok/s
Limite de taxa—
Multimodal
Entrada de imagemSaída de imagemEntrada de áudioSaída de áudio
Benchmarks
MMLU
81.0%
HumanEval
78.5%
Comparação Lado a Lado
| Modelo | Nível | Entrada | Saída | Contexto |
|---|---|---|---|---|
| Llama 4 Maverick | Flagship | $0.200 | $0.600 | 1M |
| Llama 4 Scout | Mid-tier | $0.100 | $0.300 | 10M |