OpenAI 모델
OpenAI의 모든 16개 모델을 자세한 가격, 장단점 및 개발자 추천과 함께 살펴보세요.
빠른 추천
GPT-5.6 Sol
신규FlagshipAgentic coding, complex workloads
사용 시기: Best for frontier agentic coding, deep research and mission-critical workloads where accuracy matters most.
업그레이드 하이라이트
- ◆GPT-5.6 flagship tier — released July 9, 2026
- ◆Price held at $5/$30 while Terra and Luna were cut on July 30
- ◆1.05M context, 128K max output, cache reads at $0.50/M (90% off)
장점
- Flagship tier of the GPT-5.6 family (launched Jul 9, 2026)
- 1.05M shared context window with 128K max output
- Fast mode available at 2x base price
- Explicit cache breakpoints with 30-min minimum cache life
단점
- Output still costs $30/M tokens
- No fine-tuning support yet
성능
멀티모달
GPT-5.6 Terra
신규Mid-tierBalanced performance & cost
사용 시기: The default choice for production apps, agents and high-value everyday workloads.
업그레이드 하이라이트
- ◆Price cut 20% on July 30, 2026: $2.50 → $2 input, $15 → $12 output
- ◆Cache reads at $0.20/M (90% off input)
- ◆1.05M context, 128K max output — same window as Sol
장점
- Everyday default tier of GPT-5.6
- 20% price cut on Jul 30, 2026 ($2.50/$15 → $2/$12)
- Same 1.05M context as Sol at less than half the price
단점
- Below Sol-level accuracy on the hardest tasks
- No Fast mode
성능
멀티모달
GPT-5.6 Luna
신규LiteHigh-volume, low-latency tasks
사용 시기: Ideal for chatbots, classification, extraction, batch jobs and any high-volume latency-sensitive workload.
업그레이드 하이라이트
- ◆Price slashed 80% on July 30, 2026: $1 → $0.20 input, $6 → $1.20 output
- ◆Cache reads at $0.02/M — among the cheapest frontier-family caches
- ◆~1/25 of Sol list price for high-volume work
장점
- Fastest and most affordable GPT-5.6 tier
- 80% price cut on Jul 30, 2026 ($1/$6 → $0.20/$1.20)
- Full 1.05M context at budget price
단점
- Lowest capability tier of the family
- Not suited for deep reasoning tasks
성능
멀티모달
GPT-5.5
Flagship에이전트 코딩, 복잡한 워크로드
사용 시기: 정확성이 가장 중요한 복잡한 코딩 에이전트, 컴퓨터 사용 및 전문 워크로드에 가장 적합합니다.
업그레이드 하이라이트
- ◆SWE-bench Verified: 82.7% (+6.5pp vs GPT-5.4 76.2%)
- ◆Terminal-Bench: 82.7% — 에이전트 코딩 신규 SOTA
- ◆1M 컨텍스트 윈도우 유지, 동일 지연 시간에서 GPT-5.4 대비 33% 적은 토큰
- ◆GeneBench 과학적 추론: 28.5% (+3.2pp over GPT-5.4)
- ◆가격: $5/$30 — GPT-5.4의 2배, 그러나 캐시된 입력 90% 저렴 ($0.50/M)
장점
- 최첨단 에이전트 코딩 (Terminal-Bench 82.7%)
- 1M 토큰 컨텍스트 윈도우
- 더 적은 토큰으로 GPT-5.4 지연 시간과 동등
- 강력한 과학 연구 능력
단점
- GPT-5.4보다 2배 비쌈
- 아직 미세 조정 지원 없음
- 출력 비용 $30/M 토큰
성능
멀티모달
벤치마크
이 모델을 사용하는 에이전트
7GPT-5.5 Pro
Reasoning프리미엄 정확도, 병렬 컴퓨팅
사용 시기: 법률, 의료 또는 과학 분석에 최대 정확도가 필요하고 비용이 부차적인 경우 사용하세요.
업그레이드 하이라이트
- ◆병렬 테스트 시간 컴퓨팅: 여러 추론 경로를 실행하여 최적 선택
- ◆GeneBench(과학적 추론): 33.2% — 역대 최고 기록
- ◆Pro/Business/Enterprise 구독자를 위한 전용 GPU 할당
- ◆GPT-5.5 기본과 동일한 1M 컨텍스트 + 128K 출력, 그러나 더 깊은 추론
- ◆6배 가격 프리미엄($30/$180) — 미션 크리티컬 분석에만 정당화됨
장점
- 병렬 테스트 시간 컴퓨팅을 통한 최고 정확도
- GeneBench(과학적 추론)에서 33.2% 달성
- Pro 구독자를 위한 전용 GPU 할당
단점
- GPT-5.5 기본 대비 6배 비쌈
- 배치 API 지원 없음
- Pro/Business/Enterprise 등급 전용
성능
멀티모달
벤치마크
GPT-5.5 Turbo
Mid-tier대규모 앱, 챗봇, 빠른 추론
사용 시기: GPT-5.5 품질을 낮은 비용으로 필요로 하는 대규모 프로덕션 앱(챗봇, 요약, 분류)에 최적입니다.
업그레이드 하이라이트
- ◆GPT-5.5급 품질을 출력 비용 약 33% 절감 ($20 vs $30/M)
- ◆200K 컨텍스트 윈도우 — 대부분의 프로덕션 사용 사례에 충분
- ◆빠른 추론: 실시간 애플리케이션에서 GPT-5.5보다 1.5배 빠름
- ◆GPT-5.5 베이스와 동일한 128K 최대 출력
- ◆무료 티어 제공 — 대규모 배포에 최고의 가치
장점
- GPT-5.5급 지능을 낮은 비용으로
- 200K 컨텍스트 윈도우
- GPT-5.5 대비 33% 저렴한 출력 비용
- 실시간 앱을 위한 빠른 추론
단점
- GPT-5.5 대비 작은 컨텍스트 (200K vs 1M)
- 파인튜닝 미지원
- 약간 낮은 추론 정확도
성능
멀티모달
벤치마크
GPT-5.4
Flagship코딩, 컴퓨터 사용, 지식 작업
사용 시기: 코딩 어시스턴트, 데스크톱 자동화 및 엔터프라이즈 지식 작업에 탁월한 올라운더입니다.
업그레이드 하이라이트
- ◆OSWorld: 75% — 인간 수준 데스크톱 자동화를 초과한 최초의 AI
- ◆GPT-5.2 대비 33% 적은 사실 오류 (환각 감소)
- ◆Tool Search: 동적으로 도구를 발견, 에이전트 토큰 사용량 약 40% 절감
- ◆컨텍스트: 128K → 1M 토큰 (GPT-4o 대비 8배 증가)
- ◆최대 출력: 16K → 128K 토큰 (8배 증가), 가격 $2.50/$15
장점
- 인간 데스크톱 성능을 초과한 최초의 AI (75% OSWorld)
- 통합 코딩 + 컴퓨터 사용 + 지식 작업
- GPT-5.2보다 33% 적은 사실 오류
- Tool Search로 에이전트 토큰 사용량 감소
단점
- GPT-4.1보다 비쌈
- 아직 미세 조정 불가
- 272K 컨텍스트 이상에서 입력 가격 2배
성능
멀티모달
벤치마크
GPT-5.4 Mini
Mid-tier비용 효율적인 코딩 및 개발 작업
사용 시기: 대량 코딩 작업, 챗봇 및 가벼운 개발 워크로드에 최적의 가치를 제공합니다.
업그레이드 하이라이트
- ◆SWE-bench Pro: 54.38% — GPT-5.4 Standard의 57.7%보다 3.3pp 낮음
- ◆GPT-5.4 Standard보다 6배 저렴 ($0.75 vs $5/M 입력)
- ◆400K 컨텍스트 윈도우 — 대부분의 코딩 작업에 충분
- ◆플래그십과 동일한 128K 최대 출력, 90% 캐시 입력 절감
- ◆표준 출시 후 12일 뒤 출시 — 가장 빠른 미니 변형
장점
- SWE-bench Pro 54.38% (표준 57.7%에 근접)
- GPT-5.4 Standard보다 6배 저렴
- 400K 컨텍스트 윈도우
- 무료 티어 이용 가능
단점
- 표준보다 낮은 추론 품질
- 전체 1M보다 작은 컨텍스트 윈도우
- 표준 출시 후 12일 뒤 출시
성능
멀티모달
벤치마크
GPT-5.4 Nano
Lite엣지, 임베디드, 모바일
사용 시기: 온디바이스 어시스턴트, 모바일 앱 및 네트워크 지연 시간이 중요한 시나리오에 이상적입니다.
업그레이드 하이라이트
- ◆엣지/모바일/IoT용 설계 — 온디바이스 추론에 최적화
- ◆272K 컨텍스트에서 최대 128K 출력 — 가장 높은 출력/컨텍스트 비율
- ◆비전 + 함수 호출 $0.20/M 입력 — 이전에는 플래그십 전용
- ◆실시간 모바일 상호작용을 위한 지연 시간 최적화
- ◆컨텍스트 272K vs 표준 1M — 속도와 비용 간의 트레이드오프
장점
- 엣지 배포를 위한 초저비용
- 모바일 및 IoT 기기용으로 설계됨
- 작은 크기에도 불구하고 최대 128K 출력
단점
- 제한된 벤치마크 가용성
- 더 작은 컨텍스트 윈도우
- 복잡한 작업에서의 품질 격차
성능
멀티모달
벤치마크
GPT-4o
Flagship범용, 멀티모달
사용 시기: 고품질 멀티모달 출력이 필요한 대부분의 앱에 가장 적합한 기본 선택입니다.
업그레이드 하이라이트
- ◆최초의 네이티브 멀티모달 모델: 하나의 모델에서 텍스트 + 이미지 + 오디오
- ◆GPT-4 Turbo보다 2배 빠르고 비용은 50% 저렴($2.50 vs $5/M 입력)
- ◆네이티브 오디오 이해 — 별도의 Whisper 파이프라인 불필요
- ◆도메인 적응을 위한 미세 조정 지원(플래그십 전용)
- ◆128K 컨텍스트 — 장문 문서 작업의 경우 GPT-4.1의 1M으로 대체됨
장점
- 멀티모달(텍스트 + 이미지 + 오디오)
- 탁월한 범용 품질
- 강력한 함수 호출 및 JSON 모드
단점
- 미니/나노 변형보다 높은 비용
- 128K 컨텍스트 vs 최신 4.1 모델의 1M+
성능
멀티모달
벤치마크
이 모델을 사용하는 에이전트
3GPT-4o Mini
Lite빠르고 비용 효율적인 작업
사용 시기: 챗봇 및 요약과 같은 대량 처리, 비용 민감형 워크로드에 적합합니다.
업그레이드 하이라이트
- ◆GPT-3.5 Turbo 대체: 46% 저렴, 품질 대폭 향상
- ◆GPT-4o와 동일한 128K 컨텍스트, 가격은 1/17
- ◆MMLU 82% 달성 — 지식 작업에서 GPT-4 수준에 근접
- ◆비전 + 함수 호출 $0.15/M — 이전에는 플래그십 전용 기능
- ◆파인튜닝 가능 — 튜닝 모델 중 최고의 비용/품질 비율
장점
- 매우 저렴함
- GPT-4o와 동일한 128K 컨텍스트
- 비전 + 함수 호출 지원
단점
- 플래그십 대비 낮은 추론 품질
- 복잡한 다단계 작업에 부적합
성능
멀티모달
벤치마크
GPT-4.1
Flagship코딩, 명령 수행
사용 시기: 코딩 어시스턴트 및 긴 문서 분석에 최적의 선택입니다.
업그레이드 하이라이트
- ◆컨텍스트: 128K → 100만 토큰 (GPT-4o 대비 8배 증가)
- ◆SWE-bench Verified: 54.6% — 출시 당시 최고 코딩 점수
- ◆최대 출력: 32K 토큰 (GPT-4o의 16K 대비 2배)
- ◆명령 수행: IFEval에서 GPT-4o 대비 40% 향상
- ◆GPT-4o보다 저렴 ($2 vs $2.50/M 입력) 하면서 더 많은 기능 제공
장점
- 100만 토큰 컨텍스트 창
- 최고 수준의 코딩 능력
- GPT-4o보다 저렴하고 더 나은 컨텍스트 제공
단점
- 간단한 작업에서는 mini/nano보다 느림
- 최신 모델로 검증이 덜 됨
성능
멀티모달
벤치마크
이 모델을 사용하는 에이전트
82GPT-4.1 Mini
Mid-tier균형 잡힌 성능과 비용
사용 시기: 플래그십 비용 없이 긴 컨텍스트가 필요한 프로덕션 앱에 최적의 선택입니다.
업그레이드 하이라이트
- ◆입력 100만 컨텍스트에 $0.40/M — GPT-4.1 플래그십보다 5배 저렴
- ◆프로덕션 사용 시 플래그십과 동일한 100만 컨텍스트 + 32K 출력
- ◆완전한 멀티모달 지원 (비전, 함수 호출, 파인튜닝)
- ◆SWE-bench: 42.8% — 중간 가격대에서 강력한 코딩 성능
- ◆긴 컨텍스트 프로덕션 워크로드를 위해 GPT-4o Mini 대체
장점
- 중간 가격대의 100만 컨텍스트
- 가격 대비 강력한 코딩 성능
- 완전한 멀티모달 지원
단점
- 복잡한 추론에서 플래그십 대비 품질 차이
- 여전히 나노보다 비쌈
성능
멀티모달
벤치마크
GPT-4.1 Nano
Lite초저지연, 엣지 디바이스
사용 시기: 실시간 분류, 추출 및 고처리량 파이프라인에 이상적입니다.
업그레이드 하이라이트
- ◆1M 컨텍스트를 제공하는 가장 저렴한 모델: $0.10/M 입력(GPT-3.5 Turbo는 $0.50)
- ◆라이트 계층에서 전체 기능 세트: 비전 + 함수 호출 + 파인튜닝
- ◆컨텍스트: 128K → 1M(GPT-4o Mini의 128K 대비 8배 증가)
- ◆OpenAI 라인업 중 가장 빠른 응답 시간 — 일반적인 지연 시간 200ms 미만
- ◆캐시된 입력: $0.025/M — 반복 접두사에 대해 97.5% 절감
장점
- 1M 컨텍스트를 제공하는 가장 저렴한 OpenAI 모델
- 가장 빠른 응답 시간
- 전체 기능 세트(비전, FC, 파인튜닝)
단점
- 복잡한 작업에서 눈에 띄는 품질 저하
- 심층 추론에 부적합
성능
멀티모달
벤치마크
o3
Reasoning복잡한 추론, 수학, 과학
사용 시기: 단계별 추론, 수학 증명 및 과학적 분석이 필요한 문제에 사용하세요.
업그레이드 하이라이트
- ◆ARC-AGI: 87.5% — 새로운 추상 추론 작업에서 인간 수준에 근접
- ◆최대 출력: 100K 토큰 (o1의 25K 대비 4배) 깊은 사고 사슬 지원
- ◆비전 + 함수 호출 — o1의 텍스트 전용 대비 새로운 기능
- ◆수학 올림피아드: AIME 2024에서 금메달 수준 (93.3%)
- ◆가격: $2/$8 — $200/M의 o1 Pro 대비 1/3 비용
장점
- 최첨단 추론 능력
- 장기 사고 사슬을 위한 100K 최대 출력
- 수학 및 과학에 탁월함
단점
- 사고 시간으로 인해 느림
- 파인튜닝 미지원
- 추론 토큰에 대한 높은 비용
성능
멀티모달
벤치마크
이 모델을 사용하는 에이전트
1o4-mini
Reasoning저렴한 비용으로 추론
사용 시기: 추론 작업에 최고의 가치 — o3가 과도한 프로덕션 환경에 적합합니다.
업그레이드 하이라이트
- ◆추론 작업에서 o3보다 55% 저렴 ($1.10 vs $2/M 입력)
- ◆o3와 동일한 100K 최대 출력 — 추론 깊이 타협 없음
- ◆최적화된 사고 예산으로 o3보다 빠른 추론
- ◆추론 계층에서 비전 + 함수 호출 — 이전에는 o3 전용
- ◆캐시된 입력: $0.275/M — 반복 프롬프트에 75% 절감
장점
- 추론 비용이 o3보다 55% 저렴
- 동일한 100K 최대 출력
- o3보다 빠름
단점
- 가장 어려운 문제에서 o3보다 성능 낮음
- 파인튜닝 불가
- 추론 토큰으로 인한 숨은 비용 발생
성능
멀티모달
벤치마크
이 모델을 사용하는 에이전트
1나란히 비교
| 모델 | 등급 | 입력 | 출력 | 컨텍스트 |
|---|---|---|---|---|
| GPT-5.6 Sol | Flagship | $5.00 | $30.00 | 1.1M |
| GPT-5.6 Terra | Mid-tier | $2.00 | $12.00 | 1.1M |
| GPT-5.6 Luna | Lite | $0.200 | $1.20 | 1.1M |
| GPT-5.5 | Flagship | $5.00 | $30.00 | 1M |
| GPT-5.5 Pro | Reasoning | $30.00 | $180.00 | 1M |
| GPT-5.5 Turbo | Mid-tier | $5.00 | $20.00 | 200K |
| GPT-5.4 | Flagship | $2.50 | $15.00 | 1M |
| GPT-5.4 Mini | Mid-tier | $0.750 | $4.50 | 400K |
| GPT-5.4 Nano | Lite | $0.200 | $1.25 | 272K |
| GPT-4o | Flagship | $2.50 | $10.00 | 128K |
| GPT-4o Mini | Lite | $0.150 | $0.600 | 128K |
| GPT-4.1 | Flagship | $2.00 | $8.00 | 1.0M |
| GPT-4.1 Mini | Mid-tier | $0.400 | $1.60 | 1.0M |
| GPT-4.1 Nano | Lite | $0.100 | $0.400 | 1.0M |
| o3 | Reasoning | $2.00 | $8.00 | 200K |
| o4-mini | Reasoning | $1.10 | $4.40 | 200K |