개발자 영역으로 돌아가기공식 가격 공식 가격 공식 가격 공식 가격
xAI 모델
xAI의 모든 4개 모델을 자세한 가격, 장단점 및 개발자 추천과 함께 살펴보세요.
4
모델
$0.200
최저 입력
2M
최대 컨텍스트
2
품질 등급
빠른 추천
최고 가성비: Grok 4.1 Fast ($0.200/1M)
최고 품질: Grok 4.6
Grok 4.6
신규FlagshipCoding, math, reasoning
사용 시기: Strong pick for coding agents and reasoning-heavy workloads when you want frontier quality below $5/M input.
업그레이드 하이라이트
- ◆New xAI flagship at $2/$6 per 1M tokens — undercuts Grok 4.3's successors on capability-per-dollar
- ◆500K context, cached input at $0.50/M
- ◆Grok Build 0.1 coding stack ships alongside it in public beta
입력 가격
$2.00
per 1M tokens
출력 가격
$6.00
per 1M tokens
캐시된 입력
$0.500
per 1M tokens
배치 입력
—
per 1M tokens
컨텍스트 창: 500K
최대 출력: 32,000 tokens
지식 기준일: 2026-01
비전함수 호출파인튜닝JSON 모드
장점
- xAI's smartest model — frontier coding, knowledge work and STEM
- Configurable reasoning
- Fast variant available at 2x price
- Live in GitHub Copilot
단점
- 500K context is below rivals' 1M
- No fine-tuning
성능
출력 속도—
속도 제한—
멀티모달
이미지 입력이미지 출력오디오 입력오디오 출력
Grok 4.3
Flagship범용, 최대 성능
사용 시기: 실시간 지식 접근이 필요한 범용 애플리케이션에 가장 적합한 xAI 모델입니다.
업그레이드 하이라이트
- ◆1M 컨텍스트 윈도우 — Grok 3의 128K 대비 8배 증가
- ◆가격: $1.25/$2.50 — Grok 3($3/$15) 대비 60% 저렴
- ◆실시간 웹 + X(Twitter) 검색 — 독특한 실시간 지식 접근
- ◆컨텍스트 캐싱: $0.20/M — 반복 접두사에 대해 84% 절감
- ◆32K 최대 출력 — Grok 3의 8K 대비 4배로 긴 형식 생성 가능
입력 가격
$1.25
per 1M tokens
출력 가격
$2.50
per 1M tokens
캐시된 입력
$0.200
per 1M tokens
배치 입력
—
per 1M tokens
컨텍스트 창: 1M
최대 출력: 32,000 tokens
지식 기준일: 2025-06
비전함수 호출파인튜닝JSON 모드
장점
- 1M 컨텍스트 윈도우, $1.25/M 입력
- 가장 지능적인 xAI 모델
- 실시간 웹 및 X 검색
단점
- 배치 API 없음
- 파인튜닝 없음
- 새로운 생태계
성능
출력 속도~65 tok/s
속도 제한3,000 RPM
멀티모달
이미지 입력이미지 출력오디오 입력오디오 출력
벤치마크
MMLU
87.5%
SWE-bench Verified
62.0%
GPQA
73.0%
Grok 4.1 Fast
Mid-tier비용 최적화된 프로덕션 워크로드
사용 시기: 예산 내에서 지연 시간에 민감한 프로덕션 앱 및 긴 문서 처리에 가장 적합합니다.
업그레이드 하이라이트
- ◆2M 컨텍스트 윈도우 — 모든 중간 계층 모델 중 가장 큼
- ◆$0.20/M 입력 — 대량 작업에서 Grok 4.3보다 6배 저렴
- ◆초저지연 — 500ms 미만 응답 시간에 최적화
- ◆16K 최대 출력 — Grok 3의 8K보다 2배 긴 생성
- ◆컨텍스트 캐싱: $0.05/M — 반복 접두사에 대해 75% 절감
입력 가격
$0.200
per 1M tokens
출력 가격
$0.500
per 1M tokens
캐시된 입력
$0.050
per 1M tokens
배치 입력
—
per 1M tokens
컨텍스트 창: 2M
최대 출력: 16,000 tokens
지식 기준일: 2025-04
비전함수 호출파인튜닝JSON 모드
장점
- 2M 컨텍스트 윈도우 — 중간 계층 중 가장 큼
- 매우 빠른 응답 시간
- 프론티어 API 중 가장 낮은 요금 중 하나
단점
- Grok 4.3보다 낮은 품질
- 배치 API 없음
- 파인튜닝 없음
성능
출력 속도~110 tok/s
속도 제한8,000 RPM
멀티모달
이미지 입력이미지 출력오디오 입력오디오 출력
벤치마크
MMLU
83.0%
HumanEval
80.0%
Grok 3
Flagship실시간 정보, 분석
사용 시기: 실시간 X/Twitter 데이터나 매우 최신 지식이 필수적일 때 사용하세요.
업그레이드 하이라이트
- ◆실시간 X/Twitter 통합 — 독특한 라이브 소셜 미디어 지식
- ◆지식 컷오프: 2025-02 — 현재 가장 최신 중 하나
- ◆비전 + 함수 호출 — 출시 시 완전한 멀티모달 기능
- ◆캐싱 또는 배치 API 없음 — 캐싱 지원을 위해 Grok 4.3으로 업그레이드
- ◆128K 컨텍스트 — 장문 작업을 위해 Grok 4.3의 1M으로 대체됨
입력 가격
$3.00
per 1M tokens
출력 가격
$15.00
per 1M tokens
캐시된 입력
—
per 1M tokens
배치 입력
—
per 1M tokens
컨텍스트 창: 131K
최대 출력: 8,192 tokens
지식 기준일: 2025-02
비전함수 호출파인튜닝JSON 모드
장점
- 매우 최신 지식 컷오프
- 실시간 X/Twitter 통합
- 비전 + 함수 호출
단점
- 비쌈 ($3/$15)
- 캐싱 또는 배치 없음
- 파인튜닝 없음
성능
출력 속도~55 tok/s
속도 제한2,000 RPM
멀티모달
이미지 입력이미지 출력오디오 입력오디오 출력
벤치마크
MMLU
85.0%
GPQA
68.0%
MATH
70.0%
나란히 비교
| 모델 | 등급 | 입력 | 출력 | 컨텍스트 |
|---|---|---|---|---|
| Grok 4.6 | Flagship | $2.00 | $6.00 | 500K |
| Grok 4.3 | Flagship | $1.25 | $2.50 | 1M |
| Grok 4.1 Fast | Mid-tier | $0.200 | $0.500 | 2M |
| Grok 3 | Flagship | $3.00 | $15.00 | 131K |