Назад в зону разработчика

OpenAI Модели

Изучите все 16 моделей от OpenAI с подробными ценами, плюсами и минусами, а также рекомендациями для разработчиков.

16
Модели
$0.100
Самая низкая входная цена
1.1M
Макс. контекст
4
Уровни качества

Быстрые рекомендации

Лучшее соотношение цены и качества: GPT-4.1 Nano ($0.100/1M)
Лучшее качество: GPT-5.6 Sol
Лучшее для рассуждений: GPT-5.5 Pro

GPT-5.6 Sol

НОВИНКАFlagship

Agentic coding, complex workloads

Официальные цены

Когда использовать: Best for frontier agentic coding, deep research and mission-critical workloads where accuracy matters most.

Ключевые улучшения

  • GPT-5.6 flagship tier — released July 9, 2026
  • Price held at $5/$30 while Terra and Luna were cut on July 30
  • 1.05M context, 128K max output, cache reads at $0.50/M (90% off)
Цена входа
$5.00
per 1M tokens
Цена выхода
$30.00
per 1M tokens
Кэшированный вход
$0.500
per 1M tokens
Пакетный вход
$2.50
per 1M tokens
Окно контекста: 1.1M
Макс. выход: 128,000 tokens
Дата обрезания знаний: 2026-01
ЗрениеВызов функцийТонкая настройкаРежим JSONБесплатный уровень

Плюсы

  • Flagship tier of the GPT-5.6 family (launched Jul 9, 2026)
  • 1.05M shared context window with 128K max output
  • Fast mode available at 2x base price
  • Explicit cache breakpoints with 30-min minimum cache life

Минусы

  • Output still costs $30/M tokens
  • No fine-tuning support yet

Производительность

Скорость вывода~90 tok/s
Ограничение скорости5,000 RPM

Мультимодальность

Ввод изображенияВывод изображенияВвод аудиоВывод аудио

GPT-5.6 Terra

НОВИНКАMid-tier

Balanced performance & cost

Официальные цены

Когда использовать: The default choice for production apps, agents and high-value everyday workloads.

Ключевые улучшения

  • Price cut 20% on July 30, 2026: $2.50 → $2 input, $15 → $12 output
  • Cache reads at $0.20/M (90% off input)
  • 1.05M context, 128K max output — same window as Sol
Цена входа
$2.00
per 1M tokens
Цена выхода
$12.00
per 1M tokens
Кэшированный вход
$0.200
per 1M tokens
Пакетный вход
$1.00
per 1M tokens
Окно контекста: 1.1M
Макс. выход: 128,000 tokens
Дата обрезания знаний: 2026-01
ЗрениеВызов функцийТонкая настройкаРежим JSONБесплатный уровень

Плюсы

  • Everyday default tier of GPT-5.6
  • 20% price cut on Jul 30, 2026 ($2.50/$15 → $2/$12)
  • Same 1.05M context as Sol at less than half the price

Минусы

  • Below Sol-level accuracy on the hardest tasks
  • No Fast mode

Производительность

Скорость вывода~100 tok/s
Ограничение скорости5,000 RPM

Мультимодальность

Ввод изображенияВывод изображенияВвод аудиоВывод аудио

GPT-5.6 Luna

НОВИНКАLite

High-volume, low-latency tasks

Официальные цены

Когда использовать: Ideal for chatbots, classification, extraction, batch jobs and any high-volume latency-sensitive workload.

Ключевые улучшения

  • Price slashed 80% on July 30, 2026: $1 → $0.20 input, $6 → $1.20 output
  • Cache reads at $0.02/M — among the cheapest frontier-family caches
  • ~1/25 of Sol list price for high-volume work
Цена входа
$0.200
per 1M tokens
Цена выхода
$1.20
per 1M tokens
Кэшированный вход
$0.020
per 1M tokens
Пакетный вход
$0.100
per 1M tokens
Окно контекста: 1.1M
Макс. выход: 128,000 tokens
Дата обрезания знаний: 2026-01
ЗрениеВызов функцийТонкая настройкаРежим JSONБесплатный уровень

Плюсы

  • Fastest and most affordable GPT-5.6 tier
  • 80% price cut on Jul 30, 2026 ($1/$6 → $0.20/$1.20)
  • Full 1.05M context at budget price

Минусы

  • Lowest capability tier of the family
  • Not suited for deep reasoning tasks

Производительность

Скорость вывода~160 tok/s
Ограничение скорости10,000 RPM

Мультимодальность

Ввод изображенияВывод изображенияВвод аудиоВывод аудио

GPT-5.5

Flagship

Агентное кодирование, сложные рабочие нагрузки

Официальные цены

Когда использовать: Лучше всего подходит для сложных агентов кодирования, компьютерного использования и профессиональных рабочих нагрузок, где точность имеет наибольшее значение.

Ключевые улучшения

  • SWE-bench Verified: 82,7% (+6,5 п.п. по сравнению с 76,2% у GPT-5.4)
  • Terminal-Bench: 82,7% — новый SOTA для агентного кодирования
  • Сохранено контекстное окно в 1 млн, на 33% меньше токенов по сравнению с GPT-5.4 при той же задержке
  • Научное мышление GeneBench: 28,5% (+3,2 п.п. по сравнению с GPT-5.4)
  • Цена: $5/$30 — в 2 раза дороже GPT-5.4, но кэшированный ввод на 90% дешевле: $0,50/млн
Цена входа
$5.00
per 1M tokens
Цена выхода
$30.00
per 1M tokens
Кэшированный вход
$0.500
per 1M tokens
Пакетный вход
$2.50
per 1M tokens
Окно контекста: 1M
Макс. выход: 128,000 tokens
Дата обрезания знаний: 2025-06
ЗрениеВызов функцийТонкая настройкаРежим JSONБесплатный уровень

Плюсы

  • Современное агентное кодирование (82,7% Terminal-Bench)
  • Контекстное окно в 1 млн токенов
  • Соответствует задержке GPT-5.4 при меньшем количестве токенов
  • Высокая способность к научным исследованиям

Минусы

  • В 2 раза дороже GPT-5.4
  • Пока нет поддержки тонкой настройки
  • Стоимость вывода: $30/млн токенов

Производительность

Скорость вывода~85 tok/s
Ограничение скорости5,000 RPM

Мультимодальность

Ввод изображенияВывод изображенияВвод аудиоВывод аудио

Бенчмарки

MMLU
90.0%
SWE-bench Verified
82.7%
Terminal-Bench
82.7%
GeneBench
28.5%

Агенты, использующие эту модель

7

GPT-5.5 Pro

Reasoning

Максимальная точность, параллельные вычисления

Официальные цены

Когда использовать: Используйте, когда требуется максимальная точность для юридического, медицинского или научного анализа, а стоимость вторична.

Ключевые улучшения

  • Параллельные вычисления во время тестирования: запускает несколько путей рассуждения, выбирает лучший
  • GeneBench (научное мышление): 33,2% — самый высокий показатель за всю историю
  • Выделенный GPU для подписчиков Pro/Business/Enterprise
  • Те же 1M контекста + 128K вывода, что и у базовой GPT-5.5, но более глубокое рассуждение
  • Премиум-цена в 6 раз ($30/$180) — оправдана только для критически важного анализа
Цена входа
$30.00
per 1M tokens
Цена выхода
$180.00
per 1M tokens
Кэшированный вход
per 1M tokens
Пакетный вход
per 1M tokens
Окно контекста: 1M
Макс. выход: 128,000 tokens
Дата обрезания знаний: 2025-06
ЗрениеВызов функцийТонкая настройкаРежим JSON

Плюсы

  • Наивысшая точность благодаря параллельным вычислениям во время тестирования
  • 33,2% на GeneBench (научное мышление)
  • Выделенный GPU для подписчиков Pro

Минусы

  • В 6 раз дороже базовой версии GPT-5.5
  • Нет поддержки пакетного API
  • Только для уровней Pro/Business/Enterprise

Производительность

Скорость вывода~40 tok/s
Ограничение скорости3,000 RPM

Мультимодальность

Ввод изображенияВывод изображенияВвод аудиоВывод аудио

Бенчмарки

MMLU
90.5%
GeneBench
33.2%
SWE-bench Verified
79.0%

GPT-5.5 Turbo

Mid-tier

Приложения с высоким объемом, чат-боты, быстрый вывод

Официальные цены

Когда использовать: Лучше всего подходит для высоконагруженных производственных приложений, требующих качества GPT-5.5 по более низкой цене — чат-боты, резюмирование, классификация.

Ключевые улучшения

  • Качество уровня GPT-5.5 при стоимости вывода примерно на 33% ниже ($20 против $30/M)
  • Контекстное окно 200K — достаточно для большинства производственных сценариев
  • Быстрый вывод: в 1.5 раза быстрее GPT-5.5 для приложений реального времени
  • Тот же максимальный вывод 128K, что и у базовой версии GPT-5.5
  • Доступен бесплатный тариф — лучшая ценность для высоконагруженных развертываний
Цена входа
$5.00
per 1M tokens
Цена выхода
$20.00
per 1M tokens
Кэшированный вход
$0.500
per 1M tokens
Пакетный вход
$2.50
per 1M tokens
Окно контекста: 200K
Макс. выход: 128,000 tokens
Дата обрезания знаний: 2025-06
ЗрениеВызов функцийТонкая настройкаРежим JSONБесплатный уровень

Плюсы

  • Интеллект уровня GPT-5.5 по более низкой цене
  • Контекстное окно 200K
  • Вывод на 33% дешевле, чем у GPT-5.5
  • Быстрый вывод для приложений реального времени

Минусы

  • Меньший контекст по сравнению с GPT-5.5 (200K против 1M)
  • Отсутствие поддержки тонкой настройки
  • Несколько меньшая точность рассуждений

Производительность

Скорость вывода~120 tok/s
Ограничение скорости10,000 RPM

Мультимодальность

Ввод изображенияВывод изображенияВвод аудиоВывод аудио

Бенчмарки

MMLU
88.5%
SWE-bench Verified
80.0%
HumanEval
90.0%

GPT-5.4

Flagship

Программирование, работа с компьютером, интеллектуальная работа

Официальные цены

Когда использовать: Отличный универсал для помощников по программированию, автоматизации рабочего стола и корпоративной интеллектуальной работы.

Ключевые улучшения

  • OSWorld: 75% — первый ИИ, превзошедший уровень человека в автоматизации рабочего стола
  • На 33% меньше фактических ошибок по сравнению с GPT-5.2 (снижение галлюцинаций)
  • Tool Search: динамически находит инструменты, сокращает использование токенов агентами примерно на 40%
  • Контекст: 128K → 1M токенов (увеличение в 8 раз по сравнению с GPT-4o)
  • Максимальный вывод: 16K → 128K токенов (увеличение в 8 раз), цена $2.50/$15
Цена входа
$2.50
per 1M tokens
Цена выхода
$15.00
per 1M tokens
Кэшированный вход
$0.250
per 1M tokens
Пакетный вход
$1.25
per 1M tokens
Окно контекста: 1M
Макс. выход: 128,000 tokens
Дата обрезания знаний: 2025-03
ЗрениеВызов функцийТонкая настройкаРежим JSONБесплатный уровень

Плюсы

  • Первый ИИ, превзошедший производительность человека на рабочем столе (75% OSWorld)
  • Единое решение для программирования, работы с компьютером и интеллектуальной работы
  • На 33% меньше фактических ошибок, чем у GPT-5.2
  • Tool Search снижает использование токенов для агентов

Минусы

  • Дороже, чем GPT-4.1
  • Пока нет возможности тонкой настройки
  • Цена ввода удваивается при контексте более 272K

Производительность

Скорость вывода~90 tok/s
Ограничение скорости5,000 RPM

Мультимодальность

Ввод изображенияВывод изображенияВвод аудиоВывод аудио

Бенчмарки

MMLU
89.5%
SWE-bench Verified
76.2%
OSWorld
75.0%
IFEval
87.0%

GPT-5.4 Mini

Mid-tier

Экономичное кодирование и задачи разработки

Официальные цены

Когда использовать: Лучшее соотношение цены и качества для высокообъемных задач кодирования, чат-ботов и легких рабочих нагрузок разработки.

Ключевые улучшения

  • SWE-bench Pro: 54.38% — всего на 3.3 п.п. ниже GPT-5.4 Standard (57.7%)
  • В 6 раз дешевле GPT-5.4 Standard ($0.75 против $5/М входных данных)
  • Окно контекста 400K — достаточно для большинства задач кодирования
  • Тот же максимальный вывод 128K, что и у флагмана, экономия 90% на кэшированных входных данных
  • Выпущен через 12 дней после Standard — самая быстрая мини-версия
Цена входа
$0.750
per 1M tokens
Цена выхода
$4.50
per 1M tokens
Кэшированный вход
$0.075
per 1M tokens
Пакетный вход
$0.375
per 1M tokens
Окно контекста: 400K
Макс. выход: 128,000 tokens
Дата обрезания знаний: 2025-03
ЗрениеВызов функцийТонкая настройкаРежим JSONБесплатный уровень

Плюсы

  • 54.38% SWE-bench Pro (близко к 57.7% Standard)
  • В 6 раз дешевле GPT-5.4 Standard
  • Окно контекста 400K
  • Доступен бесплатный тариф

Минусы

  • Более низкое качество рассуждений по сравнению с Standard
  • Окно контекста меньше полного 1M
  • Выпущен через 12 дней после Standard

Производительность

Скорость вывода~120 tok/s
Ограничение скорости10,000 RPM

Мультимодальность

Ввод изображенияВывод изображенияВвод аудиоВывод аудио

Бенчмарки

SWE-bench Pro
54.38%
MMLU
86.0%
HumanEval
88.2%

GPT-5.4 Nano

Lite

Edge, встраиваемые системы, мобильные устройства

Официальные цены

Когда использовать: Идеален для ассистентов на устройствах, мобильных приложений и сценариев, где важна задержка сети.

Ключевые улучшения

  • Разработан для edge/мобильных/IoT — оптимизирован для вывода на устройстве
  • Максимальный вывод 128K при контексте 272K — наивысшее соотношение вывода/контекста
  • Зрение + вызов функций за $0.20/M ввода — ранее доступно только флагманским моделям
  • Оптимизированная задержка для реального времени в мобильных взаимодействиях
  • Контекст 272K против 1M для Standard — компромисс между скоростью и стоимостью
Цена входа
$0.200
per 1M tokens
Цена выхода
$1.25
per 1M tokens
Кэшированный вход
per 1M tokens
Пакетный вход
per 1M tokens
Окно контекста: 272K
Макс. выход: 128,000 tokens
Дата обрезания знаний: 2025-03
ЗрениеВызов функцийТонкая настройкаРежим JSONБесплатный уровень

Плюсы

  • Сверхнизкая стоимость для развертывания на периферии
  • Разработан для мобильных и IoT-устройств
  • Максимальный вывод 128K при малом размере

Минусы

  • Ограниченные доступные бенчмарки
  • Меньший контекстный окно
  • Разрыв в качестве для сложных задач

Производительность

Скорость вывода~150 tok/s
Ограничение скорости15,000 RPM

Мультимодальность

Ввод изображенияВывод изображенияВвод аудиоВывод аудио

Бенчмарки

MMLU
78.5%
HumanEval
76.0%

GPT-4o

Flagship

Общего назначения, мультимодальный

Официальные цены

Когда использовать: Лучший выбор по умолчанию для большинства приложений, требующих высококачественного мультимодального вывода.

Ключевые улучшения

  • Первая нативно мультимодальная модель: текст + изображение + аудио в одной модели
  • В 2 раза быстрее GPT-4 Turbo при снижении стоимости на 50% ($2.50 против $5/M входных данных)
  • Нативное понимание аудио — без отдельного конвейера Whisper
  • Поддержка тонкой настройки для адаптации к домену (эксклюзив флагманской модели)
  • 128K контекст — заменен 1M GPT-4.1 для задач с длинными документами
Цена входа
$2.50
per 1M tokens
Цена выхода
$10.00
per 1M tokens
Кэшированный вход
$1.25
per 1M tokens
Пакетный вход
$1.25
per 1M tokens
Окно контекста: 128K
Макс. выход: 16,384 tokens
Дата обрезания знаний: 2023-10
ЗрениеВызов функцийТонкая настройкаРежим JSONБесплатный уровень

Плюсы

  • Мультимодальный (текст + изображение + аудио)
  • Отличное качество общего назначения
  • Мощный вызов функций и режим JSON

Минусы

  • Более высокая стоимость по сравнению с вариантами mini/nano
  • 128K контекст против 1M+ для новых моделей 4.1

Производительность

Скорость вывода~75 tok/s
Ограничение скорости5,000 RPM

Мультимодальность

Ввод изображенияВывод изображенияВвод аудиоВывод аудио

Бенчмарки

MMLU
88.7%
HumanEval
90.2%
MATH
76.6%
IFEval
80.4%

Агенты, использующие эту модель

3

GPT-4o Mini

Lite

Быстрые, экономичные задачи

Официальные цены

Когда использовать: Отлично подходит для высоконагруженных, чувствительных к стоимости задач, таких как чат-боты и суммаризация.

Ключевые улучшения

  • Заменил GPT-3.5 Turbo: на 46% дешевле, значительно лучше качество
  • Тот же контекст 128K, что и у GPT-4o, по цене в 17 раз ниже
  • Набрал 82% на MMLU — приближается к уровню GPT-4 в задачах на знания
  • Зрение + вызов функций за $0.15/M — ранее доступно только во флагманских моделях
  • Доступна тонкая настройка — лучшее соотношение цены и качества для настроенных моделей
Цена входа
$0.150
per 1M tokens
Цена выхода
$0.600
per 1M tokens
Кэшированный вход
$0.075
per 1M tokens
Пакетный вход
$0.075
per 1M tokens
Окно контекста: 128K
Макс. выход: 16,384 tokens
Дата обрезания знаний: 2023-10
ЗрениеВызов функцийТонкая настройкаРежим JSONБесплатный уровень

Плюсы

  • Чрезвычайно доступный
  • Тот же контекст 128K, что и у GPT-4o
  • Поддерживает зрение + вызов функций

Минусы

  • Более низкое качество рассуждений по сравнению с флагманской моделью
  • Не подходит для сложных многошаговых задач

Производительность

Скорость вывода~130 tok/s
Ограничение скорости10,000 RPM

Мультимодальность

Ввод изображенияВывод изображенияВвод аудиоВывод аудио

Бенчмарки

MMLU
82.0%
HumanEval
87.2%
MATH
67.5%

GPT-4.1

Flagship

Кодинг, следование инструкциям

Официальные цены

Когда использовать: Лучший выбор для помощников по кодингу и анализа длинных документов.

Ключевые улучшения

  • Контекст: 128K → 1M токенов (скачок в 8 раз по сравнению с GPT-4o)
  • SWE-bench Verified: 54,6% — лучший показатель кодинга на момент запуска
  • Максимальный вывод: 32K токенов (в 2 раза больше, чем 16K у GPT-4o)
  • Следование инструкциям: на 40% лучше по IFEval по сравнению с GPT-4o
  • Дешевле GPT-4o ($2 против $2,50/М вход) с большими возможностями
Цена входа
$2.00
per 1M tokens
Цена выхода
$8.00
per 1M tokens
Кэшированный вход
$0.500
per 1M tokens
Пакетный вход
$1.00
per 1M tokens
Окно контекста: 1.0M
Макс. выход: 32,768 tokens
Дата обрезания знаний: 2024-04
ЗрениеВызов функцийТонкая настройкаРежим JSONБесплатный уровень

Плюсы

  • Окно контекста в 1 млн токенов
  • Лучшая в своем классе способность к кодингу
  • Дешевле GPT-4o с лучшим контекстом

Минусы

  • Медленнее mini/nano для простых задач
  • Новая модель, менее проверенная

Производительность

Скорость вывода~70 tok/s
Ограничение скорости5,000 RPM

Мультимодальность

Ввод изображенияВывод изображенияВвод аудиоВывод аудио

Бенчмарки

MMLU
88.3%
SWE-bench Verified
54.6%
IFEval
84.0%
HumanEval
92.0%

GPT-4.1 Mini

Mid-tier

Сбалансированная производительность и стоимость

Официальные цены

Когда использовать: Идеальный вариант для продакшн-приложений, требующих длинного контекста без затрат на флагман.

Ключевые улучшения

  • 1M контекст за $0.40/M ввод — в 5 раз дешевле флагмана GPT-4.1
  • Те же 1M контекст + 32K вывод для продакшн-использования
  • Полная мультимодальная поддержка (зрение, вызов функций, тонкая настройка)
  • SWE-bench: 42.8% — сильное кодирование по средней цене
  • Заменил GPT-4o Mini для длинноконтекстных продакшн-нагрузок
Цена входа
$0.400
per 1M tokens
Цена выхода
$1.60
per 1M tokens
Кэшированный вход
$0.100
per 1M tokens
Пакетный вход
$0.200
per 1M tokens
Окно контекста: 1.0M
Макс. выход: 32,768 tokens
Дата обрезания знаний: 2024-04
ЗрениеВызов функцийТонкая настройкаРежим JSONБесплатный уровень

Плюсы

  • 1M контекст по средней цене
  • Сильное кодирование по цене
  • Полная мультимодальная поддержка

Минусы

  • Разрыв в качестве по сравнению с флагманом для сложных рассуждений
  • Все еще дороже nano

Производительность

Скорость вывода~110 tok/s
Ограничение скорости10,000 RPM

Мультимодальность

Ввод изображенияВывод изображенияВвод аудиоВывод аудио

Бенчмарки

MMLU
84.5%
SWE-bench Verified
42.8%
HumanEval
86.5%

GPT-4.1 Nano

Lite

Сверхнизкая задержка, периферийные устройства

Официальные цены

Когда использовать: Идеально подходит для классификации в реальном времени, извлечения данных и высокопроизводительных конвейеров.

Ключевые улучшения

  • Самая дешевая модель с контекстом 1M: $0.10/M ввод (GPT-3.5 Turbo был $0.50)
  • Полный набор функций на легком уровне: зрение + вызов функций + тонкая настройка
  • Контекст: 128K → 1M (увеличение в 8 раз по сравнению с 128K у GPT-4o Mini)
  • Самое быстрое время ответа в линейке OpenAI — типичная задержка менее 200 мс
  • Кэшированный ввод по $0.025/M — экономия 97.5% для повторяющихся префиксов
Цена входа
$0.100
per 1M tokens
Цена выхода
$0.400
per 1M tokens
Кэшированный вход
$0.025
per 1M tokens
Пакетный вход
$0.050
per 1M tokens
Окно контекста: 1.0M
Макс. выход: 32,768 tokens
Дата обрезания знаний: 2024-04
ЗрениеВызов функцийТонкая настройкаРежим JSONБесплатный уровень

Плюсы

  • Самая дешевая модель OpenAI с контекстом 1M
  • Самое быстрое время ответа
  • Полный набор функций (зрение, FC, тонкая настройка)

Минусы

  • Заметное снижение качества для сложных задач
  • Не подходит для глубокого анализа

Производительность

Скорость вывода~160 tok/s
Ограничение скорости15,000 RPM

Мультимодальность

Ввод изображенияВывод изображенияВвод аудиоВывод аудио

Бенчмарки

MMLU
76.0%
HumanEval
72.8%

o3

Reasoning

Сложные рассуждения, математика, наука

Официальные цены

Когда использовать: Используйте для задач, требующих пошаговых рассуждений, математических доказательств и научного анализа.

Ключевые улучшения

  • ARC-AGI: 87.5% — почти человеческий уровень на новых задачах абстрактного рассуждения
  • Максимальный вывод: 100K токенов (в 4 раза больше 25K o1) для глубокой цепочки рассуждений
  • Зрение + вызов функций — новые возможности по сравнению с текстовым o1
  • Математическая олимпиада: уровень золотой медали на AIME 2024 (93.3%)
  • Цена: $2/$8 — 1/3 стоимости o1 Pro при $200/мес
Цена входа
$2.00
per 1M tokens
Цена выхода
$8.00
per 1M tokens
Кэшированный вход
$0.500
per 1M tokens
Пакетный вход
$1.00
per 1M tokens
Окно контекста: 200K
Макс. выход: 100,000 tokens
Дата обрезания знаний: 2024-05
ЗрениеВызов функцийТонкая настройкаРежим JSONБесплатный уровень

Плюсы

  • Передовые способности к рассуждению
  • Максимальный вывод 100K для длинной цепочки рассуждений
  • Отлично справляется с математикой и наукой

Минусы

  • Медленнее из-за времени на размышления
  • Нет поддержки тонкой настройки
  • Более высокая стоимость токенов рассуждения

Производительность

Скорость вывода~25 tok/s
Ограничение скорости3,000 RPM

Мультимодальность

Ввод изображенияВывод изображенияВвод аудиоВывод аудио

Бенчмарки

ARC-AGI
87.5%
AIME 2024
93.3%
MATH
96.7%
GPQA
83.3%

Агенты, использующие эту модель

1

o4-mini

Reasoning

Рассуждения с меньшими затратами

Официальные цены

Когда использовать: Лучшее соотношение цены и качества для рабочих нагрузок рассуждений — отлично подходит для продакшена, где o3 избыточен.

Ключевые улучшения

  • На 55% дешевле o3 ($1,10 против $2/М вход) для задач рассуждений
  • Те же 100K максимального вывода, что и у o3 — без компромиссов по глубине рассуждений
  • Более быстрый вывод, чем у o3, с оптимизированным бюджетом мышления
  • Зрение + вызов функций на уровне рассуждений — ранее только o3
  • Кэшированный ввод: $0,275/М — экономия 75% для повторяющихся запросов
Цена входа
$1.10
per 1M tokens
Цена выхода
$4.40
per 1M tokens
Кэшированный вход
$0.275
per 1M tokens
Пакетный вход
$0.550
per 1M tokens
Окно контекста: 200K
Макс. выход: 100,000 tokens
Дата обрезания знаний: 2024-05
ЗрениеВызов функцийТонкая настройкаРежим JSONБесплатный уровень

Плюсы

  • На 55% дешевле o3 для рассуждений
  • Те же 100K максимального вывода
  • Быстрее o3

Минусы

  • Менее способен, чем o3, на самых сложных задачах
  • Нет тонкой настройки
  • Токены рассуждений добавляют скрытые затраты

Производительность

Скорость вывода~35 tok/s
Ограничение скорости5,000 RPM

Мультимодальность

Ввод изображенияВывод изображенияВвод аудиоВывод аудио

Бенчмарки

AIME 2024
90.0%
MATH
92.5%
GPQA
78.1%

Агенты, использующие эту модель

1

Сравнение бок о бок

МодельУровеньВходВыходКонтекст
GPT-5.6 SolFlagship$5.00$30.001.1M
GPT-5.6 TerraMid-tier$2.00$12.001.1M
GPT-5.6 LunaLite$0.200$1.201.1M
GPT-5.5Flagship$5.00$30.001M
GPT-5.5 ProReasoning$30.00$180.001M
GPT-5.5 TurboMid-tier$5.00$20.00200K
GPT-5.4Flagship$2.50$15.001M
GPT-5.4 MiniMid-tier$0.750$4.50400K
GPT-5.4 NanoLite$0.200$1.25272K
GPT-4oFlagship$2.50$10.00128K
GPT-4o MiniLite$0.150$0.600128K
GPT-4.1Flagship$2.00$8.001.0M
GPT-4.1 MiniMid-tier$0.400$1.601.0M
GPT-4.1 NanoLite$0.100$0.4001.0M
o3Reasoning$2.00$8.00200K
o4-miniReasoning$1.10$4.40200K