개발자 영역으로 돌아가기공식 가격 공식 가격
Meta 모델
Meta의 모든 2개 모델을 자세한 가격, 장단점 및 개발자 추천과 함께 살펴보세요.
2
모델
$0.100
최저 입력
10M
최대 컨텍스트
2
품질 등급
빠른 추천
최고 가성비: Llama 4 Scout ($0.100/1M)
최고 품질: Llama 4 Maverick
Llama 4 Maverick
Flagship오픈소스, 멀티모달
사용 시기: 오픈소스 제어나 자체 호스팅을 원하며 멀티모달 기능이 필요한 팀에게 적합합니다.
업그레이드 하이라이트
- ◆오픈소스 — 무료 자체 호스팅, 전체 모델 가중치 제어
- ◆100만 토큰 컨텍스트 윈도우 — 이 용량을 갖춘 최초의 오픈소스 모델
- ◆멀티모달(텍스트 + 비전) + 미세 조정 가능 — 독특한 조합
- ◆17B 활성 파라미터(총 109B) — 효율성을 위한 MoE 아키텍처
- ◆최대 출력 4K는 제한적 — 입력이 많고 출력이 짧은 작업에 사용
입력 가격
$0.200
per 1M tokens
출력 가격
$0.600
per 1M tokens
캐시된 입력
—
per 1M tokens
배치 입력
—
per 1M tokens
컨텍스트 창: 1M
최대 출력: 4,096 tokens
지식 기준일: 2024-08
비전함수 호출파인튜닝JSON 모드무료 등급
장점
- 오픈소스 — 무료로 자체 호스팅 가능
- 100만 토큰 컨텍스트 윈도우
- 멀티모달 + 미세 조정 가능
단점
- 최대 출력 4K로 제한
- JSON 모드 없음
- 타사(Together AI)를 통한 호스팅 요금
성능
출력 속도~80 tok/s
속도 제한—
멀티모달
이미지 입력이미지 출력오디오 입력오디오 출력
벤치마크
MMLU
84.5%
HumanEval
83.0%
SWE-bench Verified
44.2%
Llama 4 Scout
Mid-tier오픈소스, 긴 컨텍스트
사용 시기: 매우 긴 문서 처리에 탁월합니다. 대규모 컨텍스트 윈도우를 활용한 RAG에 최적입니다.
업그레이드 하이라이트
- ◆1천만 토큰 컨텍스트 — 다른 모델보다 10배 더 큼
- ◆오픈소스 + 미세 조정 가능 — 자체 호스팅으로 무제한 사용
- ◆$0.10/M 입력 — 시장에서 토큰당 가장 저렴한 모델
- ◆17B 활성 파라미터(총 109B) — Maverick과 동일한 효율적인 MoE
- ◆최대 출력 4K — 긴 생성보다 검색/분석에 최적화
입력 가격
$0.100
per 1M tokens
출력 가격
$0.300
per 1M tokens
캐시된 입력
—
per 1M tokens
배치 입력
—
per 1M tokens
컨텍스트 창: 10M
최대 출력: 4,096 tokens
지식 기준일: 2024-08
비전함수 호출파인튜닝JSON 모드무료 등급
장점
- 1천만 토큰 컨텍스트 — 가장 큰 규모
- 토큰당 가장 저렴한 모델
- 오픈소스 + 미세 조정 가능
단점
- 최대 출력 4K만 지원
- JSON 모드 없음
- 독점 플래그십 대비 품질 낮음
성능
출력 속도~90 tok/s
속도 제한—
멀티모달
이미지 입력이미지 출력오디오 입력오디오 출력
벤치마크
MMLU
81.0%
HumanEval
78.5%
나란히 비교
| 모델 | 등급 | 입력 | 출력 | 컨텍스트 |
|---|---|---|---|---|
| Llama 4 Maverick | Flagship | $0.200 | $0.600 | 1M |
| Llama 4 Scout | Mid-tier | $0.100 | $0.300 | 10M |