Voltar à Zona do Desenvolvedor

Meta Modelos

Explore todos os 2 modelos de Meta com preços detalhados, prós e contras e recomendações para desenvolvedores.

2
Modelos
$0.100
Menor Entrada
10M
Contexto Máximo
2
Níveis de Qualidade

Recomendações Rápidas

Melhor Custo-Benefício: Llama 4 Scout ($0.100/1M)
Melhor Qualidade: Llama 4 Maverick

Llama 4 Maverick

Flagship

Código aberto, multimodal

Preços Oficiais

Quando usar: Para equipes que desejam controle de código aberto ou auto-hospedagem com necessidades multimodais.

Destaques da Atualização

  • Código aberto — auto-hospede gratuitamente, controle total dos pesos do modelo
  • Janela de contexto de 1M — primeiro modelo de código aberto com essa capacidade
  • Multimodal (texto + visão) + ajustável — combinação única
  • 17B parâmetros ativos (109B total) — arquitetura MoE para eficiência
  • Saída máxima de 4K é limitante — use para tarefas com muita entrada e pouca saída
Preço de Entrada
$0.200
per 1M tokens
Preço de Saída
$0.600
per 1M tokens
Entrada em Cache
per 1M tokens
Entrada em Lote
per 1M tokens
Janela de Contexto: 1M
Saída Máxima: 4,096 tokens
Corte de Conhecimento: 2024-08
VisãoChamada de FunçãoAjuste FinoModo JSONNível Gratuito

Prós

  • Código aberto — pode auto-hospedar gratuitamente
  • Janela de contexto de 1M
  • Multimodal + ajustável

Contras

  • Apenas 4K de saída máxima
  • Sem modo JSON
  • Preço hospedado via terceiros (Together AI)

Desempenho

Velocidade de saída~80 tok/s
Limite de taxa

Multimodal

Entrada de imagemSaída de imagemEntrada de áudioSaída de áudio

Benchmarks

MMLU
84.5%
HumanEval
83.0%
SWE-bench Verified
44.2%

Llama 4 Scout

Mid-tier

Código aberto, contexto longo

Preços Oficiais

Quando usar: Inigualável para processar documentos muito longos. Melhor para RAG com janelas de contexto massivas.

Destaques da Atualização

  • Contexto de 10 milhões de tokens — 10x maior que qualquer outro modelo disponível
  • Código aberto + ajustável — auto-hospedagem para uso ilimitado
  • $0,10/M de entrada — modelo mais barato por token no mercado
  • 17B parâmetros ativos (109B total) — mesmo MoE eficiente que o Maverick
  • 4K de saída máxima — projetado para recuperação/análise, não para geração longa
Preço de Entrada
$0.100
per 1M tokens
Preço de Saída
$0.300
per 1M tokens
Entrada em Cache
per 1M tokens
Entrada em Lote
per 1M tokens
Janela de Contexto: 10M
Saída Máxima: 4,096 tokens
Corte de Conhecimento: 2024-08
VisãoChamada de FunçãoAjuste FinoModo JSONNível Gratuito

Prós

  • Contexto de 10 milhões de tokens — o maior disponível
  • Modelo mais barato por token
  • Código aberto + ajustável

Contras

  • Apenas 4K de saída máxima
  • Sem modo JSON
  • Qualidade inferior aos carros-chefe proprietários

Desempenho

Velocidade de saída~90 tok/s
Limite de taxa

Multimodal

Entrada de imagemSaída de imagemEntrada de áudioSaída de áudio

Benchmarks

MMLU
81.0%
HumanEval
78.5%

Comparação Lado a Lado

ModeloNívelEntradaSaídaContexto
Llama 4 MaverickFlagship$0.200$0.6001M
Llama 4 ScoutMid-tier$0.100$0.30010M