Retour à l'espace développeurTarifs officiels Tarifs officiels
Meta Modèles
Explorez les 2 modèles de Meta avec des prix détaillés, avantages et inconvénients, et recommandations pour développeurs.
2
Modèles
$0.100
Entrée la moins chère
10M
Contexte max
2
Niveaux de qualité
Recommandations rapides
Meilleur rapport qualité-prix: Llama 4 Scout ($0.100/1M)
Meilleure qualité: Llama 4 Maverick
Llama 4 Maverick
FlagshipOpen-source, multimodal
Quand l'utiliser: Pour les équipes souhaitant un contrôle open-source ou un auto-hébergement avec des besoins multimodaux.
Points clés de la mise à niveau
- ◆Open-source — auto-hébergement gratuit, contrôle total des poids du modèle
- ◆Fenêtre de contexte de 1M — premier modèle open-source avec cette capacité
- ◆Multimodal (texte + vision) + ajustable finement — combinaison unique
- ◆17B paramètres actifs (109B au total) — architecture MoE pour l'efficacité
- ◆Sortie maximale de 4K limitante — à utiliser pour des tâches à forte entrée et courte sortie
Prix d'entrée
$0.200
per 1M tokens
Prix de sortie
$0.600
per 1M tokens
Entrée en cache
—
per 1M tokens
Entrée batch
—
per 1M tokens
Fenêtre de contexte: 1M
Sortie max: 4,096 tokens
Date de coupure des connaissances: 2024-08
VisionAppel de fonctionAjustement finMode JSONNiveau gratuit
Avantages
- Open-source — possibilité d'auto-hébergement gratuit
- Fenêtre de contexte de 1M
- Multimodal + ajustable finement
Inconvénients
- Sortie maximale de seulement 4K
- Pas de mode JSON
- Tarification hébergée via un tiers (Together AI)
Performance
Vitesse de sortie~80 tok/s
Limite de débit—
Multimodal
Entrée imageSortie imageEntrée audioSortie audio
Benchmarks
MMLU
84.5%
HumanEval
83.0%
SWE-bench Verified
44.2%
Llama 4 Scout
Mid-tierOpen-source, contexte long
Quand l'utiliser: Inégalé pour le traitement de très longs documents. Idéal pour le RAG avec des fenêtres de contexte massives.
Points clés de la mise à niveau
- ◆Contexte de 10 millions de tokens — 10 fois plus grand que tout autre modèle disponible
- ◆Open-source + ajustable finement — auto-hébergement pour une utilisation illimitée
- ◆0,10 $/M d'entrée — modèle le moins cher par token sur le marché
- ◆17B paramètres actifs (109B au total) — MoE efficace identique à Maverick
- ◆Sortie maximale de 4K — conçu pour la récupération/analyse, pas pour la génération longue
Prix d'entrée
$0.100
per 1M tokens
Prix de sortie
$0.300
per 1M tokens
Entrée en cache
—
per 1M tokens
Entrée batch
—
per 1M tokens
Fenêtre de contexte: 10M
Sortie max: 4,096 tokens
Date de coupure des connaissances: 2024-08
VisionAppel de fonctionAjustement finMode JSONNiveau gratuit
Avantages
- Contexte de 10 millions de tokens — le plus grand disponible
- Modèle le moins cher par token
- Open-source + ajustable finement
Inconvénients
- Sortie maximale de seulement 4K
- Pas de mode JSON
- Qualité inférieure aux flagships propriétaires
Performance
Vitesse de sortie~90 tok/s
Limite de débit—
Multimodal
Entrée imageSortie imageEntrée audioSortie audio
Benchmarks
MMLU
81.0%
HumanEval
78.5%
Comparaison côte à côte
| Modèle | Niveau | Entrée | Sortie | Contexte |
|---|---|---|---|---|
| Llama 4 Maverick | Flagship | $0.200 | $0.600 | 1M |
| Llama 4 Scout | Mid-tier | $0.100 | $0.300 | 10M |