개발자 영역으로 돌아가기

Meta 모델

Meta의 모든 2개 모델을 자세한 가격, 장단점 및 개발자 추천과 함께 살펴보세요.

2
모델
$0.100
최저 입력
10M
최대 컨텍스트
2
품질 등급

빠른 추천

최고 가성비: Llama 4 Scout ($0.100/1M)
최고 품질: Llama 4 Maverick

Llama 4 Maverick

Flagship

오픈소스, 멀티모달

공식 가격

사용 시기: 오픈소스 제어나 자체 호스팅을 원하며 멀티모달 기능이 필요한 팀에게 적합합니다.

업그레이드 하이라이트

  • 오픈소스 — 무료 자체 호스팅, 전체 모델 가중치 제어
  • 100만 토큰 컨텍스트 윈도우 — 이 용량을 갖춘 최초의 오픈소스 모델
  • 멀티모달(텍스트 + 비전) + 미세 조정 가능 — 독특한 조합
  • 17B 활성 파라미터(총 109B) — 효율성을 위한 MoE 아키텍처
  • 최대 출력 4K는 제한적 — 입력이 많고 출력이 짧은 작업에 사용
입력 가격
$0.200
per 1M tokens
출력 가격
$0.600
per 1M tokens
캐시된 입력
per 1M tokens
배치 입력
per 1M tokens
컨텍스트 창: 1M
최대 출력: 4,096 tokens
지식 기준일: 2024-08
비전함수 호출파인튜닝JSON 모드무료 등급

장점

  • 오픈소스 — 무료로 자체 호스팅 가능
  • 100만 토큰 컨텍스트 윈도우
  • 멀티모달 + 미세 조정 가능

단점

  • 최대 출력 4K로 제한
  • JSON 모드 없음
  • 타사(Together AI)를 통한 호스팅 요금

성능

출력 속도~80 tok/s
속도 제한

멀티모달

이미지 입력이미지 출력오디오 입력오디오 출력

벤치마크

MMLU
84.5%
HumanEval
83.0%
SWE-bench Verified
44.2%

Llama 4 Scout

Mid-tier

오픈소스, 긴 컨텍스트

공식 가격

사용 시기: 매우 긴 문서 처리에 탁월합니다. 대규모 컨텍스트 윈도우를 활용한 RAG에 최적입니다.

업그레이드 하이라이트

  • 1천만 토큰 컨텍스트 — 다른 모델보다 10배 더 큼
  • 오픈소스 + 미세 조정 가능 — 자체 호스팅으로 무제한 사용
  • $0.10/M 입력 — 시장에서 토큰당 가장 저렴한 모델
  • 17B 활성 파라미터(총 109B) — Maverick과 동일한 효율적인 MoE
  • 최대 출력 4K — 긴 생성보다 검색/분석에 최적화
입력 가격
$0.100
per 1M tokens
출력 가격
$0.300
per 1M tokens
캐시된 입력
per 1M tokens
배치 입력
per 1M tokens
컨텍스트 창: 10M
최대 출력: 4,096 tokens
지식 기준일: 2024-08
비전함수 호출파인튜닝JSON 모드무료 등급

장점

  • 1천만 토큰 컨텍스트 — 가장 큰 규모
  • 토큰당 가장 저렴한 모델
  • 오픈소스 + 미세 조정 가능

단점

  • 최대 출력 4K만 지원
  • JSON 모드 없음
  • 독점 플래그십 대비 품질 낮음

성능

출력 속도~90 tok/s
속도 제한

멀티모달

이미지 입력이미지 출력오디오 입력오디오 출력

벤치마크

MMLU
81.0%
HumanEval
78.5%

나란히 비교

모델등급입력출력컨텍스트
Llama 4 MaverickFlagship$0.200$0.6001M
Llama 4 ScoutMid-tier$0.100$0.30010M