Zurück zur EntwicklerzoneOffizielle Preise Offizielle Preise
Meta Modelle
Entdecken Sie alle 2 Modelle von Meta mit detaillierten Preisen, Vor- und Nachteilen sowie Entwicklerempfehlungen.
2
Modelle
$0.100
Niedrigster Input
10M
Max. Kontext
2
Qualitätsstufen
Schnellempfehlungen
Bestes Preis-Leistungs-Verhältnis: Llama 4 Scout ($0.100/1M)
Beste Qualität: Llama 4 Maverick
Llama 4 Maverick
FlagshipOpen-Source, multimodal
Wann verwenden: Für Teams, die Open-Source-Kontrolle oder Self-Hosting mit multimodalen Anforderungen wünschen.
Upgrade-Highlights
- ◆Open-Source — selbst hosten kostenlos, volle Kontrolle über Modellgewichte
- ◆1M Kontextfenster — erstes Open-Source-Modell mit dieser Kapazität
- ◆Multimodal (Text + Vision) + feinabstimmbar — einzigartige Kombination
- ◆17B aktive Parameter (109B gesamt) — MoE-Architektur für Effizienz
- ◆4K maximale Ausgabe ist begrenzend — für eingabeintensive, ausgabearme Aufgaben verwenden
Input-Preis
$0.200
per 1M tokens
Output-Preis
$0.600
per 1M tokens
Cached Input
—
per 1M tokens
Batch-Input
—
per 1M tokens
Kontextfenster: 1M
Max. Output: 4,096 tokens
Wissensstand: 2024-08
VisionFunktionsaufrufFeinabstimmungJSON-ModusKostenlose Stufe
Vorteile
- Open-Source — kann kostenlos selbst gehostet werden
- 1M Kontextfenster
- Multimodal + feinabstimmbar
Nachteile
- Nur 4K maximale Ausgabe
- Kein JSON-Modus
- Gehostete Preise über Drittanbieter (Together AI)
Leistung
Ausgabegeschwindigkeit~80 tok/s
Rate-Limit—
Multimodal
BildeingabeBildausgabeAudioeingabeAudioausgabe
Benchmarks
MMLU
84.5%
HumanEval
83.0%
SWE-bench Verified
44.2%
Llama 4 Scout
Mid-tierOpen-Source, langer Kontext
Wann verwenden: Unübertroffen für die Verarbeitung sehr langer Dokumente. Am besten für RAG mit massiven Kontextfenstern.
Upgrade-Highlights
- ◆10 Millionen Token Kontext — 10x größer als jedes andere verfügbare Modell
- ◆Open-Source + feinabstimmbar — selbst hosten für unbegrenzte Nutzung
- ◆$0,10/M Eingabe — günstigstes Modell pro Token auf dem Markt
- ◆17B aktive Parameter (109B insgesamt) — gleiches effizientes MoE wie Maverick
- ◆4K maximale Ausgabe — für Abruf/Analyse konzipiert, nicht für lange Generierung
Input-Preis
$0.100
per 1M tokens
Output-Preis
$0.300
per 1M tokens
Cached Input
—
per 1M tokens
Batch-Input
—
per 1M tokens
Kontextfenster: 10M
Max. Output: 4,096 tokens
Wissensstand: 2024-08
VisionFunktionsaufrufFeinabstimmungJSON-ModusKostenlose Stufe
Vorteile
- 10 Millionen Token Kontext — der größte verfügbare
- Günstigstes Modell pro Token
- Open-Source + feinabstimmbar
Nachteile
- Nur 4K maximale Ausgabe
- Kein JSON-Modus
- Qualität unter proprietären Flaggschiffen
Leistung
Ausgabegeschwindigkeit~90 tok/s
Rate-Limit—
Multimodal
BildeingabeBildausgabeAudioeingabeAudioausgabe
Benchmarks
MMLU
81.0%
HumanEval
78.5%
Nebeneinander-Vergleich
| Modell | Stufe | Input | Output | Kontext |
|---|---|---|---|---|
| Llama 4 Maverick | Flagship | $0.200 | $0.600 | 1M |
| Llama 4 Scout | Mid-tier | $0.100 | $0.300 | 10M |