Retour à l'espace développeur

Meta Modèles

Explorez les 2 modèles de Meta avec des prix détaillés, avantages et inconvénients, et recommandations pour développeurs.

2
Modèles
$0.100
Entrée la moins chère
10M
Contexte max
2
Niveaux de qualité

Recommandations rapides

Meilleur rapport qualité-prix: Llama 4 Scout ($0.100/1M)
Meilleure qualité: Llama 4 Maverick

Llama 4 Maverick

Flagship

Open-source, multimodal

Tarifs officiels

Quand l'utiliser: Pour les équipes souhaitant un contrôle open-source ou un auto-hébergement avec des besoins multimodaux.

Points clés de la mise à niveau

  • Open-source — auto-hébergement gratuit, contrôle total des poids du modèle
  • Fenêtre de contexte de 1M — premier modèle open-source avec cette capacité
  • Multimodal (texte + vision) + ajustable finement — combinaison unique
  • 17B paramètres actifs (109B au total) — architecture MoE pour l'efficacité
  • Sortie maximale de 4K limitante — à utiliser pour des tâches à forte entrée et courte sortie
Prix d'entrée
$0.200
per 1M tokens
Prix de sortie
$0.600
per 1M tokens
Entrée en cache
per 1M tokens
Entrée batch
per 1M tokens
Fenêtre de contexte: 1M
Sortie max: 4,096 tokens
Date de coupure des connaissances: 2024-08
VisionAppel de fonctionAjustement finMode JSONNiveau gratuit

Avantages

  • Open-source — possibilité d'auto-hébergement gratuit
  • Fenêtre de contexte de 1M
  • Multimodal + ajustable finement

Inconvénients

  • Sortie maximale de seulement 4K
  • Pas de mode JSON
  • Tarification hébergée via un tiers (Together AI)

Performance

Vitesse de sortie~80 tok/s
Limite de débit

Multimodal

Entrée imageSortie imageEntrée audioSortie audio

Benchmarks

MMLU
84.5%
HumanEval
83.0%
SWE-bench Verified
44.2%

Llama 4 Scout

Mid-tier

Open-source, contexte long

Tarifs officiels

Quand l'utiliser: Inégalé pour le traitement de très longs documents. Idéal pour le RAG avec des fenêtres de contexte massives.

Points clés de la mise à niveau

  • Contexte de 10 millions de tokens — 10 fois plus grand que tout autre modèle disponible
  • Open-source + ajustable finement — auto-hébergement pour une utilisation illimitée
  • 0,10 $/M d'entrée — modèle le moins cher par token sur le marché
  • 17B paramètres actifs (109B au total) — MoE efficace identique à Maverick
  • Sortie maximale de 4K — conçu pour la récupération/analyse, pas pour la génération longue
Prix d'entrée
$0.100
per 1M tokens
Prix de sortie
$0.300
per 1M tokens
Entrée en cache
per 1M tokens
Entrée batch
per 1M tokens
Fenêtre de contexte: 10M
Sortie max: 4,096 tokens
Date de coupure des connaissances: 2024-08
VisionAppel de fonctionAjustement finMode JSONNiveau gratuit

Avantages

  • Contexte de 10 millions de tokens — le plus grand disponible
  • Modèle le moins cher par token
  • Open-source + ajustable finement

Inconvénients

  • Sortie maximale de seulement 4K
  • Pas de mode JSON
  • Qualité inférieure aux flagships propriétaires

Performance

Vitesse de sortie~90 tok/s
Limite de débit

Multimodal

Entrée imageSortie imageEntrée audioSortie audio

Benchmarks

MMLU
81.0%
HumanEval
78.5%

Comparaison côte à côte

ModèleNiveauEntréeSortieContexte
Llama 4 MaverickFlagship$0.200$0.6001M
Llama 4 ScoutMid-tier$0.100$0.30010M