Zurück zur Entwicklerzone

Meta Modelle

Entdecken Sie alle 2 Modelle von Meta mit detaillierten Preisen, Vor- und Nachteilen sowie Entwicklerempfehlungen.

2
Modelle
$0.100
Niedrigster Input
10M
Max. Kontext
2
Qualitätsstufen

Schnellempfehlungen

Bestes Preis-Leistungs-Verhältnis: Llama 4 Scout ($0.100/1M)
Beste Qualität: Llama 4 Maverick

Llama 4 Maverick

Flagship

Open-Source, multimodal

Offizielle Preise

Wann verwenden: Für Teams, die Open-Source-Kontrolle oder Self-Hosting mit multimodalen Anforderungen wünschen.

Upgrade-Highlights

  • Open-Source — selbst hosten kostenlos, volle Kontrolle über Modellgewichte
  • 1M Kontextfenster — erstes Open-Source-Modell mit dieser Kapazität
  • Multimodal (Text + Vision) + feinabstimmbar — einzigartige Kombination
  • 17B aktive Parameter (109B gesamt) — MoE-Architektur für Effizienz
  • 4K maximale Ausgabe ist begrenzend — für eingabeintensive, ausgabearme Aufgaben verwenden
Input-Preis
$0.200
per 1M tokens
Output-Preis
$0.600
per 1M tokens
Cached Input
per 1M tokens
Batch-Input
per 1M tokens
Kontextfenster: 1M
Max. Output: 4,096 tokens
Wissensstand: 2024-08
VisionFunktionsaufrufFeinabstimmungJSON-ModusKostenlose Stufe

Vorteile

  • Open-Source — kann kostenlos selbst gehostet werden
  • 1M Kontextfenster
  • Multimodal + feinabstimmbar

Nachteile

  • Nur 4K maximale Ausgabe
  • Kein JSON-Modus
  • Gehostete Preise über Drittanbieter (Together AI)

Leistung

Ausgabegeschwindigkeit~80 tok/s
Rate-Limit

Multimodal

BildeingabeBildausgabeAudioeingabeAudioausgabe

Benchmarks

MMLU
84.5%
HumanEval
83.0%
SWE-bench Verified
44.2%

Llama 4 Scout

Mid-tier

Open-Source, langer Kontext

Offizielle Preise

Wann verwenden: Unübertroffen für die Verarbeitung sehr langer Dokumente. Am besten für RAG mit massiven Kontextfenstern.

Upgrade-Highlights

  • 10 Millionen Token Kontext — 10x größer als jedes andere verfügbare Modell
  • Open-Source + feinabstimmbar — selbst hosten für unbegrenzte Nutzung
  • $0,10/M Eingabe — günstigstes Modell pro Token auf dem Markt
  • 17B aktive Parameter (109B insgesamt) — gleiches effizientes MoE wie Maverick
  • 4K maximale Ausgabe — für Abruf/Analyse konzipiert, nicht für lange Generierung
Input-Preis
$0.100
per 1M tokens
Output-Preis
$0.300
per 1M tokens
Cached Input
per 1M tokens
Batch-Input
per 1M tokens
Kontextfenster: 10M
Max. Output: 4,096 tokens
Wissensstand: 2024-08
VisionFunktionsaufrufFeinabstimmungJSON-ModusKostenlose Stufe

Vorteile

  • 10 Millionen Token Kontext — der größte verfügbare
  • Günstigstes Modell pro Token
  • Open-Source + feinabstimmbar

Nachteile

  • Nur 4K maximale Ausgabe
  • Kein JSON-Modus
  • Qualität unter proprietären Flaggschiffen

Leistung

Ausgabegeschwindigkeit~90 tok/s
Rate-Limit

Multimodal

BildeingabeBildausgabeAudioeingabeAudioausgabe

Benchmarks

MMLU
81.0%
HumanEval
78.5%

Nebeneinander-Vergleich

ModellStufeInputOutputKontext
Llama 4 MaverickFlagship$0.200$0.6001M
Llama 4 ScoutMid-tier$0.100$0.30010M