개발자 영역으로 돌아가기

OpenAI 모델

OpenAI의 모든 16개 모델을 자세한 가격, 장단점 및 개발자 추천과 함께 살펴보세요.

16
모델
$0.100
최저 입력
1.1M
최대 컨텍스트
4
품질 등급

빠른 추천

최고 가성비: GPT-4.1 Nano ($0.100/1M)
최고 품질: GPT-5.6 Sol
추론에 최적: GPT-5.5 Pro

GPT-5.6 Sol

신규Flagship

Agentic coding, complex workloads

공식 가격

사용 시기: Best for frontier agentic coding, deep research and mission-critical workloads where accuracy matters most.

업그레이드 하이라이트

  • GPT-5.6 flagship tier — released July 9, 2026
  • Price held at $5/$30 while Terra and Luna were cut on July 30
  • 1.05M context, 128K max output, cache reads at $0.50/M (90% off)
입력 가격
$5.00
per 1M tokens
출력 가격
$30.00
per 1M tokens
캐시된 입력
$0.500
per 1M tokens
배치 입력
$2.50
per 1M tokens
컨텍스트 창: 1.1M
최대 출력: 128,000 tokens
지식 기준일: 2026-01
비전함수 호출파인튜닝JSON 모드무료 등급

장점

  • Flagship tier of the GPT-5.6 family (launched Jul 9, 2026)
  • 1.05M shared context window with 128K max output
  • Fast mode available at 2x base price
  • Explicit cache breakpoints with 30-min minimum cache life

단점

  • Output still costs $30/M tokens
  • No fine-tuning support yet

성능

출력 속도~90 tok/s
속도 제한5,000 RPM

멀티모달

이미지 입력이미지 출력오디오 입력오디오 출력

GPT-5.6 Terra

신규Mid-tier

Balanced performance & cost

공식 가격

사용 시기: The default choice for production apps, agents and high-value everyday workloads.

업그레이드 하이라이트

  • Price cut 20% on July 30, 2026: $2.50 → $2 input, $15 → $12 output
  • Cache reads at $0.20/M (90% off input)
  • 1.05M context, 128K max output — same window as Sol
입력 가격
$2.00
per 1M tokens
출력 가격
$12.00
per 1M tokens
캐시된 입력
$0.200
per 1M tokens
배치 입력
$1.00
per 1M tokens
컨텍스트 창: 1.1M
최대 출력: 128,000 tokens
지식 기준일: 2026-01
비전함수 호출파인튜닝JSON 모드무료 등급

장점

  • Everyday default tier of GPT-5.6
  • 20% price cut on Jul 30, 2026 ($2.50/$15 → $2/$12)
  • Same 1.05M context as Sol at less than half the price

단점

  • Below Sol-level accuracy on the hardest tasks
  • No Fast mode

성능

출력 속도~100 tok/s
속도 제한5,000 RPM

멀티모달

이미지 입력이미지 출력오디오 입력오디오 출력

GPT-5.6 Luna

신규Lite

High-volume, low-latency tasks

공식 가격

사용 시기: Ideal for chatbots, classification, extraction, batch jobs and any high-volume latency-sensitive workload.

업그레이드 하이라이트

  • Price slashed 80% on July 30, 2026: $1 → $0.20 input, $6 → $1.20 output
  • Cache reads at $0.02/M — among the cheapest frontier-family caches
  • ~1/25 of Sol list price for high-volume work
입력 가격
$0.200
per 1M tokens
출력 가격
$1.20
per 1M tokens
캐시된 입력
$0.020
per 1M tokens
배치 입력
$0.100
per 1M tokens
컨텍스트 창: 1.1M
최대 출력: 128,000 tokens
지식 기준일: 2026-01
비전함수 호출파인튜닝JSON 모드무료 등급

장점

  • Fastest and most affordable GPT-5.6 tier
  • 80% price cut on Jul 30, 2026 ($1/$6 → $0.20/$1.20)
  • Full 1.05M context at budget price

단점

  • Lowest capability tier of the family
  • Not suited for deep reasoning tasks

성능

출력 속도~160 tok/s
속도 제한10,000 RPM

멀티모달

이미지 입력이미지 출력오디오 입력오디오 출력

GPT-5.5

Flagship

에이전트 코딩, 복잡한 워크로드

공식 가격

사용 시기: 정확성이 가장 중요한 복잡한 코딩 에이전트, 컴퓨터 사용 및 전문 워크로드에 가장 적합합니다.

업그레이드 하이라이트

  • SWE-bench Verified: 82.7% (+6.5pp vs GPT-5.4 76.2%)
  • Terminal-Bench: 82.7% — 에이전트 코딩 신규 SOTA
  • 1M 컨텍스트 윈도우 유지, 동일 지연 시간에서 GPT-5.4 대비 33% 적은 토큰
  • GeneBench 과학적 추론: 28.5% (+3.2pp over GPT-5.4)
  • 가격: $5/$30 — GPT-5.4의 2배, 그러나 캐시된 입력 90% 저렴 ($0.50/M)
입력 가격
$5.00
per 1M tokens
출력 가격
$30.00
per 1M tokens
캐시된 입력
$0.500
per 1M tokens
배치 입력
$2.50
per 1M tokens
컨텍스트 창: 1M
최대 출력: 128,000 tokens
지식 기준일: 2025-06
비전함수 호출파인튜닝JSON 모드무료 등급

장점

  • 최첨단 에이전트 코딩 (Terminal-Bench 82.7%)
  • 1M 토큰 컨텍스트 윈도우
  • 더 적은 토큰으로 GPT-5.4 지연 시간과 동등
  • 강력한 과학 연구 능력

단점

  • GPT-5.4보다 2배 비쌈
  • 아직 미세 조정 지원 없음
  • 출력 비용 $30/M 토큰

성능

출력 속도~85 tok/s
속도 제한5,000 RPM

멀티모달

이미지 입력이미지 출력오디오 입력오디오 출력

벤치마크

MMLU
90.0%
SWE-bench Verified
82.7%
Terminal-Bench
82.7%
GeneBench
28.5%

이 모델을 사용하는 에이전트

7

GPT-5.5 Pro

Reasoning

프리미엄 정확도, 병렬 컴퓨팅

공식 가격

사용 시기: 법률, 의료 또는 과학 분석에 최대 정확도가 필요하고 비용이 부차적인 경우 사용하세요.

업그레이드 하이라이트

  • 병렬 테스트 시간 컴퓨팅: 여러 추론 경로를 실행하여 최적 선택
  • GeneBench(과학적 추론): 33.2% — 역대 최고 기록
  • Pro/Business/Enterprise 구독자를 위한 전용 GPU 할당
  • GPT-5.5 기본과 동일한 1M 컨텍스트 + 128K 출력, 그러나 더 깊은 추론
  • 6배 가격 프리미엄($30/$180) — 미션 크리티컬 분석에만 정당화됨
입력 가격
$30.00
per 1M tokens
출력 가격
$180.00
per 1M tokens
캐시된 입력
per 1M tokens
배치 입력
per 1M tokens
컨텍스트 창: 1M
최대 출력: 128,000 tokens
지식 기준일: 2025-06
비전함수 호출파인튜닝JSON 모드

장점

  • 병렬 테스트 시간 컴퓨팅을 통한 최고 정확도
  • GeneBench(과학적 추론)에서 33.2% 달성
  • Pro 구독자를 위한 전용 GPU 할당

단점

  • GPT-5.5 기본 대비 6배 비쌈
  • 배치 API 지원 없음
  • Pro/Business/Enterprise 등급 전용

성능

출력 속도~40 tok/s
속도 제한3,000 RPM

멀티모달

이미지 입력이미지 출력오디오 입력오디오 출력

벤치마크

MMLU
90.5%
GeneBench
33.2%
SWE-bench Verified
79.0%

GPT-5.5 Turbo

Mid-tier

대규모 앱, 챗봇, 빠른 추론

공식 가격

사용 시기: GPT-5.5 품질을 낮은 비용으로 필요로 하는 대규모 프로덕션 앱(챗봇, 요약, 분류)에 최적입니다.

업그레이드 하이라이트

  • GPT-5.5급 품질을 출력 비용 약 33% 절감 ($20 vs $30/M)
  • 200K 컨텍스트 윈도우 — 대부분의 프로덕션 사용 사례에 충분
  • 빠른 추론: 실시간 애플리케이션에서 GPT-5.5보다 1.5배 빠름
  • GPT-5.5 베이스와 동일한 128K 최대 출력
  • 무료 티어 제공 — 대규모 배포에 최고의 가치
입력 가격
$5.00
per 1M tokens
출력 가격
$20.00
per 1M tokens
캐시된 입력
$0.500
per 1M tokens
배치 입력
$2.50
per 1M tokens
컨텍스트 창: 200K
최대 출력: 128,000 tokens
지식 기준일: 2025-06
비전함수 호출파인튜닝JSON 모드무료 등급

장점

  • GPT-5.5급 지능을 낮은 비용으로
  • 200K 컨텍스트 윈도우
  • GPT-5.5 대비 33% 저렴한 출력 비용
  • 실시간 앱을 위한 빠른 추론

단점

  • GPT-5.5 대비 작은 컨텍스트 (200K vs 1M)
  • 파인튜닝 미지원
  • 약간 낮은 추론 정확도

성능

출력 속도~120 tok/s
속도 제한10,000 RPM

멀티모달

이미지 입력이미지 출력오디오 입력오디오 출력

벤치마크

MMLU
88.5%
SWE-bench Verified
80.0%
HumanEval
90.0%

GPT-5.4

Flagship

코딩, 컴퓨터 사용, 지식 작업

공식 가격

사용 시기: 코딩 어시스턴트, 데스크톱 자동화 및 엔터프라이즈 지식 작업에 탁월한 올라운더입니다.

업그레이드 하이라이트

  • OSWorld: 75% — 인간 수준 데스크톱 자동화를 초과한 최초의 AI
  • GPT-5.2 대비 33% 적은 사실 오류 (환각 감소)
  • Tool Search: 동적으로 도구를 발견, 에이전트 토큰 사용량 약 40% 절감
  • 컨텍스트: 128K → 1M 토큰 (GPT-4o 대비 8배 증가)
  • 최대 출력: 16K → 128K 토큰 (8배 증가), 가격 $2.50/$15
입력 가격
$2.50
per 1M tokens
출력 가격
$15.00
per 1M tokens
캐시된 입력
$0.250
per 1M tokens
배치 입력
$1.25
per 1M tokens
컨텍스트 창: 1M
최대 출력: 128,000 tokens
지식 기준일: 2025-03
비전함수 호출파인튜닝JSON 모드무료 등급

장점

  • 인간 데스크톱 성능을 초과한 최초의 AI (75% OSWorld)
  • 통합 코딩 + 컴퓨터 사용 + 지식 작업
  • GPT-5.2보다 33% 적은 사실 오류
  • Tool Search로 에이전트 토큰 사용량 감소

단점

  • GPT-4.1보다 비쌈
  • 아직 미세 조정 불가
  • 272K 컨텍스트 이상에서 입력 가격 2배

성능

출력 속도~90 tok/s
속도 제한5,000 RPM

멀티모달

이미지 입력이미지 출력오디오 입력오디오 출력

벤치마크

MMLU
89.5%
SWE-bench Verified
76.2%
OSWorld
75.0%
IFEval
87.0%

GPT-5.4 Mini

Mid-tier

비용 효율적인 코딩 및 개발 작업

공식 가격

사용 시기: 대량 코딩 작업, 챗봇 및 가벼운 개발 워크로드에 최적의 가치를 제공합니다.

업그레이드 하이라이트

  • SWE-bench Pro: 54.38% — GPT-5.4 Standard의 57.7%보다 3.3pp 낮음
  • GPT-5.4 Standard보다 6배 저렴 ($0.75 vs $5/M 입력)
  • 400K 컨텍스트 윈도우 — 대부분의 코딩 작업에 충분
  • 플래그십과 동일한 128K 최대 출력, 90% 캐시 입력 절감
  • 표준 출시 후 12일 뒤 출시 — 가장 빠른 미니 변형
입력 가격
$0.750
per 1M tokens
출력 가격
$4.50
per 1M tokens
캐시된 입력
$0.075
per 1M tokens
배치 입력
$0.375
per 1M tokens
컨텍스트 창: 400K
최대 출력: 128,000 tokens
지식 기준일: 2025-03
비전함수 호출파인튜닝JSON 모드무료 등급

장점

  • SWE-bench Pro 54.38% (표준 57.7%에 근접)
  • GPT-5.4 Standard보다 6배 저렴
  • 400K 컨텍스트 윈도우
  • 무료 티어 이용 가능

단점

  • 표준보다 낮은 추론 품질
  • 전체 1M보다 작은 컨텍스트 윈도우
  • 표준 출시 후 12일 뒤 출시

성능

출력 속도~120 tok/s
속도 제한10,000 RPM

멀티모달

이미지 입력이미지 출력오디오 입력오디오 출력

벤치마크

SWE-bench Pro
54.38%
MMLU
86.0%
HumanEval
88.2%

GPT-5.4 Nano

Lite

엣지, 임베디드, 모바일

공식 가격

사용 시기: 온디바이스 어시스턴트, 모바일 앱 및 네트워크 지연 시간이 중요한 시나리오에 이상적입니다.

업그레이드 하이라이트

  • 엣지/모바일/IoT용 설계 — 온디바이스 추론에 최적화
  • 272K 컨텍스트에서 최대 128K 출력 — 가장 높은 출력/컨텍스트 비율
  • 비전 + 함수 호출 $0.20/M 입력 — 이전에는 플래그십 전용
  • 실시간 모바일 상호작용을 위한 지연 시간 최적화
  • 컨텍스트 272K vs 표준 1M — 속도와 비용 간의 트레이드오프
입력 가격
$0.200
per 1M tokens
출력 가격
$1.25
per 1M tokens
캐시된 입력
per 1M tokens
배치 입력
per 1M tokens
컨텍스트 창: 272K
최대 출력: 128,000 tokens
지식 기준일: 2025-03
비전함수 호출파인튜닝JSON 모드무료 등급

장점

  • 엣지 배포를 위한 초저비용
  • 모바일 및 IoT 기기용으로 설계됨
  • 작은 크기에도 불구하고 최대 128K 출력

단점

  • 제한된 벤치마크 가용성
  • 더 작은 컨텍스트 윈도우
  • 복잡한 작업에서의 품질 격차

성능

출력 속도~150 tok/s
속도 제한15,000 RPM

멀티모달

이미지 입력이미지 출력오디오 입력오디오 출력

벤치마크

MMLU
78.5%
HumanEval
76.0%

GPT-4o

Flagship

범용, 멀티모달

공식 가격

사용 시기: 고품질 멀티모달 출력이 필요한 대부분의 앱에 가장 적합한 기본 선택입니다.

업그레이드 하이라이트

  • 최초의 네이티브 멀티모달 모델: 하나의 모델에서 텍스트 + 이미지 + 오디오
  • GPT-4 Turbo보다 2배 빠르고 비용은 50% 저렴($2.50 vs $5/M 입력)
  • 네이티브 오디오 이해 — 별도의 Whisper 파이프라인 불필요
  • 도메인 적응을 위한 미세 조정 지원(플래그십 전용)
  • 128K 컨텍스트 — 장문 문서 작업의 경우 GPT-4.1의 1M으로 대체됨
입력 가격
$2.50
per 1M tokens
출력 가격
$10.00
per 1M tokens
캐시된 입력
$1.25
per 1M tokens
배치 입력
$1.25
per 1M tokens
컨텍스트 창: 128K
최대 출력: 16,384 tokens
지식 기준일: 2023-10
비전함수 호출파인튜닝JSON 모드무료 등급

장점

  • 멀티모달(텍스트 + 이미지 + 오디오)
  • 탁월한 범용 품질
  • 강력한 함수 호출 및 JSON 모드

단점

  • 미니/나노 변형보다 높은 비용
  • 128K 컨텍스트 vs 최신 4.1 모델의 1M+

성능

출력 속도~75 tok/s
속도 제한5,000 RPM

멀티모달

이미지 입력이미지 출력오디오 입력오디오 출력

벤치마크

MMLU
88.7%
HumanEval
90.2%
MATH
76.6%
IFEval
80.4%

이 모델을 사용하는 에이전트

3

GPT-4o Mini

Lite

빠르고 비용 효율적인 작업

공식 가격

사용 시기: 챗봇 및 요약과 같은 대량 처리, 비용 민감형 워크로드에 적합합니다.

업그레이드 하이라이트

  • GPT-3.5 Turbo 대체: 46% 저렴, 품질 대폭 향상
  • GPT-4o와 동일한 128K 컨텍스트, 가격은 1/17
  • MMLU 82% 달성 — 지식 작업에서 GPT-4 수준에 근접
  • 비전 + 함수 호출 $0.15/M — 이전에는 플래그십 전용 기능
  • 파인튜닝 가능 — 튜닝 모델 중 최고의 비용/품질 비율
입력 가격
$0.150
per 1M tokens
출력 가격
$0.600
per 1M tokens
캐시된 입력
$0.075
per 1M tokens
배치 입력
$0.075
per 1M tokens
컨텍스트 창: 128K
최대 출력: 16,384 tokens
지식 기준일: 2023-10
비전함수 호출파인튜닝JSON 모드무료 등급

장점

  • 매우 저렴함
  • GPT-4o와 동일한 128K 컨텍스트
  • 비전 + 함수 호출 지원

단점

  • 플래그십 대비 낮은 추론 품질
  • 복잡한 다단계 작업에 부적합

성능

출력 속도~130 tok/s
속도 제한10,000 RPM

멀티모달

이미지 입력이미지 출력오디오 입력오디오 출력

벤치마크

MMLU
82.0%
HumanEval
87.2%
MATH
67.5%

GPT-4.1

Flagship

코딩, 명령 수행

공식 가격

사용 시기: 코딩 어시스턴트 및 긴 문서 분석에 최적의 선택입니다.

업그레이드 하이라이트

  • 컨텍스트: 128K → 100만 토큰 (GPT-4o 대비 8배 증가)
  • SWE-bench Verified: 54.6% — 출시 당시 최고 코딩 점수
  • 최대 출력: 32K 토큰 (GPT-4o의 16K 대비 2배)
  • 명령 수행: IFEval에서 GPT-4o 대비 40% 향상
  • GPT-4o보다 저렴 ($2 vs $2.50/M 입력) 하면서 더 많은 기능 제공
입력 가격
$2.00
per 1M tokens
출력 가격
$8.00
per 1M tokens
캐시된 입력
$0.500
per 1M tokens
배치 입력
$1.00
per 1M tokens
컨텍스트 창: 1.0M
최대 출력: 32,768 tokens
지식 기준일: 2024-04
비전함수 호출파인튜닝JSON 모드무료 등급

장점

  • 100만 토큰 컨텍스트 창
  • 최고 수준의 코딩 능력
  • GPT-4o보다 저렴하고 더 나은 컨텍스트 제공

단점

  • 간단한 작업에서는 mini/nano보다 느림
  • 최신 모델로 검증이 덜 됨

성능

출력 속도~70 tok/s
속도 제한5,000 RPM

멀티모달

이미지 입력이미지 출력오디오 입력오디오 출력

벤치마크

MMLU
88.3%
SWE-bench Verified
54.6%
IFEval
84.0%
HumanEval
92.0%

GPT-4.1 Mini

Mid-tier

균형 잡힌 성능과 비용

공식 가격

사용 시기: 플래그십 비용 없이 긴 컨텍스트가 필요한 프로덕션 앱에 최적의 선택입니다.

업그레이드 하이라이트

  • 입력 100만 컨텍스트에 $0.40/M — GPT-4.1 플래그십보다 5배 저렴
  • 프로덕션 사용 시 플래그십과 동일한 100만 컨텍스트 + 32K 출력
  • 완전한 멀티모달 지원 (비전, 함수 호출, 파인튜닝)
  • SWE-bench: 42.8% — 중간 가격대에서 강력한 코딩 성능
  • 긴 컨텍스트 프로덕션 워크로드를 위해 GPT-4o Mini 대체
입력 가격
$0.400
per 1M tokens
출력 가격
$1.60
per 1M tokens
캐시된 입력
$0.100
per 1M tokens
배치 입력
$0.200
per 1M tokens
컨텍스트 창: 1.0M
최대 출력: 32,768 tokens
지식 기준일: 2024-04
비전함수 호출파인튜닝JSON 모드무료 등급

장점

  • 중간 가격대의 100만 컨텍스트
  • 가격 대비 강력한 코딩 성능
  • 완전한 멀티모달 지원

단점

  • 복잡한 추론에서 플래그십 대비 품질 차이
  • 여전히 나노보다 비쌈

성능

출력 속도~110 tok/s
속도 제한10,000 RPM

멀티모달

이미지 입력이미지 출력오디오 입력오디오 출력

벤치마크

MMLU
84.5%
SWE-bench Verified
42.8%
HumanEval
86.5%

GPT-4.1 Nano

Lite

초저지연, 엣지 디바이스

공식 가격

사용 시기: 실시간 분류, 추출 및 고처리량 파이프라인에 이상적입니다.

업그레이드 하이라이트

  • 1M 컨텍스트를 제공하는 가장 저렴한 모델: $0.10/M 입력(GPT-3.5 Turbo는 $0.50)
  • 라이트 계층에서 전체 기능 세트: 비전 + 함수 호출 + 파인튜닝
  • 컨텍스트: 128K → 1M(GPT-4o Mini의 128K 대비 8배 증가)
  • OpenAI 라인업 중 가장 빠른 응답 시간 — 일반적인 지연 시간 200ms 미만
  • 캐시된 입력: $0.025/M — 반복 접두사에 대해 97.5% 절감
입력 가격
$0.100
per 1M tokens
출력 가격
$0.400
per 1M tokens
캐시된 입력
$0.025
per 1M tokens
배치 입력
$0.050
per 1M tokens
컨텍스트 창: 1.0M
최대 출력: 32,768 tokens
지식 기준일: 2024-04
비전함수 호출파인튜닝JSON 모드무료 등급

장점

  • 1M 컨텍스트를 제공하는 가장 저렴한 OpenAI 모델
  • 가장 빠른 응답 시간
  • 전체 기능 세트(비전, FC, 파인튜닝)

단점

  • 복잡한 작업에서 눈에 띄는 품질 저하
  • 심층 추론에 부적합

성능

출력 속도~160 tok/s
속도 제한15,000 RPM

멀티모달

이미지 입력이미지 출력오디오 입력오디오 출력

벤치마크

MMLU
76.0%
HumanEval
72.8%

o3

Reasoning

복잡한 추론, 수학, 과학

공식 가격

사용 시기: 단계별 추론, 수학 증명 및 과학적 분석이 필요한 문제에 사용하세요.

업그레이드 하이라이트

  • ARC-AGI: 87.5% — 새로운 추상 추론 작업에서 인간 수준에 근접
  • 최대 출력: 100K 토큰 (o1의 25K 대비 4배) 깊은 사고 사슬 지원
  • 비전 + 함수 호출 — o1의 텍스트 전용 대비 새로운 기능
  • 수학 올림피아드: AIME 2024에서 금메달 수준 (93.3%)
  • 가격: $2/$8 — $200/M의 o1 Pro 대비 1/3 비용
입력 가격
$2.00
per 1M tokens
출력 가격
$8.00
per 1M tokens
캐시된 입력
$0.500
per 1M tokens
배치 입력
$1.00
per 1M tokens
컨텍스트 창: 200K
최대 출력: 100,000 tokens
지식 기준일: 2024-05
비전함수 호출파인튜닝JSON 모드무료 등급

장점

  • 최첨단 추론 능력
  • 장기 사고 사슬을 위한 100K 최대 출력
  • 수학 및 과학에 탁월함

단점

  • 사고 시간으로 인해 느림
  • 파인튜닝 미지원
  • 추론 토큰에 대한 높은 비용

성능

출력 속도~25 tok/s
속도 제한3,000 RPM

멀티모달

이미지 입력이미지 출력오디오 입력오디오 출력

벤치마크

ARC-AGI
87.5%
AIME 2024
93.3%
MATH
96.7%
GPQA
83.3%

이 모델을 사용하는 에이전트

1

o4-mini

Reasoning

저렴한 비용으로 추론

공식 가격

사용 시기: 추론 작업에 최고의 가치 — o3가 과도한 프로덕션 환경에 적합합니다.

업그레이드 하이라이트

  • 추론 작업에서 o3보다 55% 저렴 ($1.10 vs $2/M 입력)
  • o3와 동일한 100K 최대 출력 — 추론 깊이 타협 없음
  • 최적화된 사고 예산으로 o3보다 빠른 추론
  • 추론 계층에서 비전 + 함수 호출 — 이전에는 o3 전용
  • 캐시된 입력: $0.275/M — 반복 프롬프트에 75% 절감
입력 가격
$1.10
per 1M tokens
출력 가격
$4.40
per 1M tokens
캐시된 입력
$0.275
per 1M tokens
배치 입력
$0.550
per 1M tokens
컨텍스트 창: 200K
최대 출력: 100,000 tokens
지식 기준일: 2024-05
비전함수 호출파인튜닝JSON 모드무료 등급

장점

  • 추론 비용이 o3보다 55% 저렴
  • 동일한 100K 최대 출력
  • o3보다 빠름

단점

  • 가장 어려운 문제에서 o3보다 성능 낮음
  • 파인튜닝 불가
  • 추론 토큰으로 인한 숨은 비용 발생

성능

출력 속도~35 tok/s
속도 제한5,000 RPM

멀티모달

이미지 입력이미지 출력오디오 입력오디오 출력

벤치마크

AIME 2024
90.0%
MATH
92.5%
GPQA
78.1%

이 모델을 사용하는 에이전트

1

나란히 비교

모델등급입력출력컨텍스트
GPT-5.6 SolFlagship$5.00$30.001.1M
GPT-5.6 TerraMid-tier$2.00$12.001.1M
GPT-5.6 LunaLite$0.200$1.201.1M
GPT-5.5Flagship$5.00$30.001M
GPT-5.5 ProReasoning$30.00$180.001M
GPT-5.5 TurboMid-tier$5.00$20.00200K
GPT-5.4Flagship$2.50$15.001M
GPT-5.4 MiniMid-tier$0.750$4.50400K
GPT-5.4 NanoLite$0.200$1.25272K
GPT-4oFlagship$2.50$10.00128K
GPT-4o MiniLite$0.150$0.600128K
GPT-4.1Flagship$2.00$8.001.0M
GPT-4.1 MiniMid-tier$0.400$1.601.0M
GPT-4.1 NanoLite$0.100$0.4001.0M
o3Reasoning$2.00$8.00200K
o4-miniReasoning$1.10$4.40200K