개발자 영역으로 돌아가기공식 가격 공식 가격 공식 가격 공식 가격
DeepSeek 모델
DeepSeek의 모든 4개 모델을 자세한 가격, 장단점 및 개발자 추천과 함께 살펴보세요.
4
모델
$0.220
최저 입력
1M
최대 컨텍스트
2
품질 등급
빠른 추천
최고 가성비: DeepSeek V4 Flash ($0.220/1M)
최고 품질: DeepSeek V4 Flash
추론에 최적: DeepSeek V4 Pro
DeepSeek V4 Pro
Reasoning심층 추론, 복잡한 분석
사용 시기: 수학, 논리, 분석을 위한 대용량 출력을 갖춘 최고의 예산 추론 모델입니다.
업그레이드 하이라이트
- ◆384K 최대 출력 — 시장에서 가장 큼 (GPT-5.5의 128K 대비 3배)
- ◆1M 컨텍스트 윈도우 — DeepSeek R1의 65K 대비 16배 증가
- ◆추론 시 GPT-5.5보다 99% 저렴 ($0.435 vs $5/M 입력)
- ◆캐시된 입력: $0.003625/M — 반복 접두사에 대해 99.2% 절감
- ◆생각 모드: 추가 비용 없이 전환 가능한 심층 추론
입력 가격
$1.32
per 1M tokens
출력 가격
$1.98
per 1M tokens
캐시된 입력
$0.022
per 1M tokens
배치 입력
—
per 1M tokens
컨텍스트 창: 1M
최대 출력: 384,000 tokens
지식 기준일: 2025-06
비전함수 호출파인튜닝JSON 모드
장점
- 384K 최대 출력 — 가장 큰 가용량
- 1M 컨텍스트 윈도우
- 추론 시 GPT-5.5보다 99% 저렴
단점
- 비전 지원 없음
- 파인튜닝 없음
- 생각 모드가 토큰 오버헤드 추가
성능
출력 속도~30 tok/s
속도 제한2,000 RPM
멀티모달
이미지 입력이미지 출력오디오 입력오디오 출력
벤치마크
MMLU
88.0%
AIME 2024
85.0%
SWE-bench Verified
71.0%
MATH
82.5%
DeepSeek V4 Flash
Flagship초저가 코딩, 일반 작업
사용 시기: 비용이 가장 중요한 고려 사항인 대량 코딩 및 일반 작업에 가장 적합합니다.
업그레이드 하이라이트
- ◆가장 저렴한 LLM: $0.14/M 입력, $0.28/M 출력
- ◆1M 컨텍스트 + 384K 출력 — V4 Pro와 동일한 용량, 1/3 가격
- ◆이중 모드: 사고 및 비사고 — 작업 복잡성에 따라 전환
- ◆캐시된 입력: $0.0028/M — 시스템 프롬프트에 대해 98% 절감
- ◆비전 없음 — 텍스트 전용; 멀티모달이 필요하면 GPT-4.1 또는 Gemini 사용
입력 가격
$0.220
per 1M tokens
출력 가격
$0.660
per 1M tokens
캐시된 입력
$0.0028
per 1M tokens
배치 입력
—
per 1M tokens
컨텍스트 창: 1M
최대 출력: 384,000 tokens
지식 기준일: 2025-06
비전함수 호출파인튜닝JSON 모드
장점
- 가장 저렴한 LLM: $0.14/M 입력
- 1M 컨텍스트 + 384K 출력
- 사고 모드와 비사고 모드 모두 지원
단점
- 비전 지원 없음
- 복잡한 작업에서 GPT-5.4 이하 품질
- 파인튜닝 없음
성능
출력 속도~60 tok/s
속도 제한5,000 RPM
멀티모달
이미지 입력이미지 출력오디오 입력오디오 출력
벤치마크
MMLU
84.5%
HumanEval
86.0%
SWE-bench Verified
55.0%
DeepSeek V3
Flagship코딩, 수학, 추론
사용 시기: 코딩 중심 작업에 가장 적합한 예산 플래그십. GPT-4.1 대비 10배 저렴하면서도 비슷한 품질.
업그레이드 하이라이트
- ◆GPT-4.1 대비 10배 저렴 ($0.27 vs $2/M 입력)하며 비슷한 코딩 성능
- ◆파인튜닝 가능 — 도메인 특화 코딩 작업에 맞춤 설정
- ◆프롬프트 캐싱: $0.07/M — 반복 시스템 프롬프트에 74% 절감
- ◆671B MoE 파라미터 중 37B 활성 — 예산 가격에 플래그십 지능
- ◆65K 컨텍스트는 1M 경쟁사 대비 작음 — 긴 컨텍스트 필요 시 V4로 업그레이드
입력 가격
$0.270
per 1M tokens
출력 가격
$1.10
per 1M tokens
캐시된 입력
$0.070
per 1M tokens
배치 입력
—
per 1M tokens
컨텍스트 창: 66K
최대 출력: 8,192 tokens
지식 기준일: 2024-07
비전함수 호출파인튜닝JSON 모드
장점
- 플래그십 품질 대비 매우 저렴
- 뛰어난 코딩 및 수학 능력
- 파인튜닝 및 캐싱 가능
단점
- 컨텍스트 65K로 제한
- 비전 기능 없음
- 함수 호출 신뢰성 제한적
성능
출력 속도~50 tok/s
속도 제한3,000 RPM
멀티모달
이미지 입력이미지 출력오디오 입력오디오 출력
벤치마크
MMLU
87.1%
SWE-bench Verified
50.0%
MATH
75.0%
HumanEval
89.0%
DeepSeek R1
Reasoning심층 추론, 수학 증명
사용 시기: 예산 추론 모델 — 수학/논리 파이프라인에서 o3 비용이 부담될 때 사용하세요.
업그레이드 하이라이트
- ◆비교 가능한 추론에서 o3보다 4배 저렴 ($0.55 vs $2/M 입력)
- ◆AIME 2024: 79.8% — 수학 벤치마크에서 o1과 경쟁
- ◆프롬프트 캐싱: $0.14/M — 반복 접두사에 대해 75% 절감
- ◆오픈소스 추론 모델 — 자체 호스팅으로 무제한 사용
- ◆함수 호출이나 비전 없음 — 순수 추론; 도구 사용을 위해 V4 Pro로 업그레이드
입력 가격
$0.550
per 1M tokens
출력 가격
$2.19
per 1M tokens
캐시된 입력
$0.140
per 1M tokens
배치 입력
—
per 1M tokens
컨텍스트 창: 66K
최대 출력: 8,192 tokens
지식 기준일: 2024-07
비전함수 호출파인튜닝JSON 모드
장점
- 추론 비용이 o3보다 4배 저렴
- 강력한 수학 및 논리
- 우수한 프롬프트 캐싱 절감
단점
- 함수 호출 불가
- 비전 또는 파인튜닝 없음
- 65K 컨텍스트만 지원
성능
출력 속도~20 tok/s
속도 제한2,000 RPM
멀티모달
이미지 입력이미지 출력오디오 입력오디오 출력
벤치마크
AIME 2024
79.8%
MATH
97.3%
GPQA
71.5%
나란히 비교
| 모델 | 등급 | 입력 | 출력 | 컨텍스트 |
|---|---|---|---|---|
| DeepSeek V4 Pro | Reasoning | $1.32 | $1.98 | 1M |
| DeepSeek V4 Flash | Flagship | $0.220 | $0.660 | 1M |
| DeepSeek V3 | Flagship | $0.270 | $1.10 | 66K |
| DeepSeek R1 | Reasoning | $0.550 | $2.19 | 66K |