개발자 영역으로 돌아가기

DeepSeek 모델

DeepSeek의 모든 4개 모델을 자세한 가격, 장단점 및 개발자 추천과 함께 살펴보세요.

4
모델
$0.220
최저 입력
1M
최대 컨텍스트
2
품질 등급

빠른 추천

최고 가성비: DeepSeek V4 Flash ($0.220/1M)
최고 품질: DeepSeek V4 Flash
추론에 최적: DeepSeek V4 Pro

DeepSeek V4 Pro

Reasoning

심층 추론, 복잡한 분석

공식 가격

사용 시기: 수학, 논리, 분석을 위한 대용량 출력을 갖춘 최고의 예산 추론 모델입니다.

업그레이드 하이라이트

  • 384K 최대 출력 — 시장에서 가장 큼 (GPT-5.5의 128K 대비 3배)
  • 1M 컨텍스트 윈도우 — DeepSeek R1의 65K 대비 16배 증가
  • 추론 시 GPT-5.5보다 99% 저렴 ($0.435 vs $5/M 입력)
  • 캐시된 입력: $0.003625/M — 반복 접두사에 대해 99.2% 절감
  • 생각 모드: 추가 비용 없이 전환 가능한 심층 추론
입력 가격
$1.32
per 1M tokens
출력 가격
$1.98
per 1M tokens
캐시된 입력
$0.022
per 1M tokens
배치 입력
per 1M tokens
컨텍스트 창: 1M
최대 출력: 384,000 tokens
지식 기준일: 2025-06
비전함수 호출파인튜닝JSON 모드

장점

  • 384K 최대 출력 — 가장 큰 가용량
  • 1M 컨텍스트 윈도우
  • 추론 시 GPT-5.5보다 99% 저렴

단점

  • 비전 지원 없음
  • 파인튜닝 없음
  • 생각 모드가 토큰 오버헤드 추가

성능

출력 속도~30 tok/s
속도 제한2,000 RPM

멀티모달

이미지 입력이미지 출력오디오 입력오디오 출력

벤치마크

MMLU
88.0%
AIME 2024
85.0%
SWE-bench Verified
71.0%
MATH
82.5%

DeepSeek V4 Flash

Flagship

초저가 코딩, 일반 작업

공식 가격

사용 시기: 비용이 가장 중요한 고려 사항인 대량 코딩 및 일반 작업에 가장 적합합니다.

업그레이드 하이라이트

  • 가장 저렴한 LLM: $0.14/M 입력, $0.28/M 출력
  • 1M 컨텍스트 + 384K 출력 — V4 Pro와 동일한 용량, 1/3 가격
  • 이중 모드: 사고 및 비사고 — 작업 복잡성에 따라 전환
  • 캐시된 입력: $0.0028/M — 시스템 프롬프트에 대해 98% 절감
  • 비전 없음 — 텍스트 전용; 멀티모달이 필요하면 GPT-4.1 또는 Gemini 사용
입력 가격
$0.220
per 1M tokens
출력 가격
$0.660
per 1M tokens
캐시된 입력
$0.0028
per 1M tokens
배치 입력
per 1M tokens
컨텍스트 창: 1M
최대 출력: 384,000 tokens
지식 기준일: 2025-06
비전함수 호출파인튜닝JSON 모드

장점

  • 가장 저렴한 LLM: $0.14/M 입력
  • 1M 컨텍스트 + 384K 출력
  • 사고 모드와 비사고 모드 모두 지원

단점

  • 비전 지원 없음
  • 복잡한 작업에서 GPT-5.4 이하 품질
  • 파인튜닝 없음

성능

출력 속도~60 tok/s
속도 제한5,000 RPM

멀티모달

이미지 입력이미지 출력오디오 입력오디오 출력

벤치마크

MMLU
84.5%
HumanEval
86.0%
SWE-bench Verified
55.0%

DeepSeek V3

Flagship

코딩, 수학, 추론

공식 가격

사용 시기: 코딩 중심 작업에 가장 적합한 예산 플래그십. GPT-4.1 대비 10배 저렴하면서도 비슷한 품질.

업그레이드 하이라이트

  • GPT-4.1 대비 10배 저렴 ($0.27 vs $2/M 입력)하며 비슷한 코딩 성능
  • 파인튜닝 가능 — 도메인 특화 코딩 작업에 맞춤 설정
  • 프롬프트 캐싱: $0.07/M — 반복 시스템 프롬프트에 74% 절감
  • 671B MoE 파라미터 중 37B 활성 — 예산 가격에 플래그십 지능
  • 65K 컨텍스트는 1M 경쟁사 대비 작음 — 긴 컨텍스트 필요 시 V4로 업그레이드
입력 가격
$0.270
per 1M tokens
출력 가격
$1.10
per 1M tokens
캐시된 입력
$0.070
per 1M tokens
배치 입력
per 1M tokens
컨텍스트 창: 66K
최대 출력: 8,192 tokens
지식 기준일: 2024-07
비전함수 호출파인튜닝JSON 모드

장점

  • 플래그십 품질 대비 매우 저렴
  • 뛰어난 코딩 및 수학 능력
  • 파인튜닝 및 캐싱 가능

단점

  • 컨텍스트 65K로 제한
  • 비전 기능 없음
  • 함수 호출 신뢰성 제한적

성능

출력 속도~50 tok/s
속도 제한3,000 RPM

멀티모달

이미지 입력이미지 출력오디오 입력오디오 출력

벤치마크

MMLU
87.1%
SWE-bench Verified
50.0%
MATH
75.0%
HumanEval
89.0%

이 모델을 사용하는 에이전트

2

DeepSeek R1

Reasoning

심층 추론, 수학 증명

공식 가격

사용 시기: 예산 추론 모델 — 수학/논리 파이프라인에서 o3 비용이 부담될 때 사용하세요.

업그레이드 하이라이트

  • 비교 가능한 추론에서 o3보다 4배 저렴 ($0.55 vs $2/M 입력)
  • AIME 2024: 79.8% — 수학 벤치마크에서 o1과 경쟁
  • 프롬프트 캐싱: $0.14/M — 반복 접두사에 대해 75% 절감
  • 오픈소스 추론 모델 — 자체 호스팅으로 무제한 사용
  • 함수 호출이나 비전 없음 — 순수 추론; 도구 사용을 위해 V4 Pro로 업그레이드
입력 가격
$0.550
per 1M tokens
출력 가격
$2.19
per 1M tokens
캐시된 입력
$0.140
per 1M tokens
배치 입력
per 1M tokens
컨텍스트 창: 66K
최대 출력: 8,192 tokens
지식 기준일: 2024-07
비전함수 호출파인튜닝JSON 모드

장점

  • 추론 비용이 o3보다 4배 저렴
  • 강력한 수학 및 논리
  • 우수한 프롬프트 캐싱 절감

단점

  • 함수 호출 불가
  • 비전 또는 파인튜닝 없음
  • 65K 컨텍스트만 지원

성능

출력 속도~20 tok/s
속도 제한2,000 RPM

멀티모달

이미지 입력이미지 출력오디오 입력오디오 출력

벤치마크

AIME 2024
79.8%
MATH
97.3%
GPQA
71.5%

나란히 비교

모델등급입력출력컨텍스트
DeepSeek V4 ProReasoning$1.32$1.981M
DeepSeek V4 FlashFlagship$0.220$0.6601M
DeepSeek V3Flagship$0.270$1.1066K
DeepSeek R1Reasoning$0.550$2.1966K