Назад в зону разработчика

DeepSeek Модели

Изучите все 4 моделей от DeepSeek с подробными ценами, плюсами и минусами, а также рекомендациями для разработчиков.

4
Модели
$0.220
Самая низкая входная цена
1M
Макс. контекст
2
Уровни качества

Быстрые рекомендации

Лучшее соотношение цены и качества: DeepSeek V4 Flash ($0.220/1M)
Лучшее качество: DeepSeek V4 Flash
Лучшее для рассуждений: DeepSeek V4 Pro

DeepSeek V4 Pro

Reasoning

Глубокие рассуждения, сложный анализ

Официальные цены

Когда использовать: Лучшая бюджетная модель рассуждений с огромной выходной мощностью для математики, логики и анализа.

Ключевые улучшения

  • 384K макс. вывод — самый большой на рынке (в 3 раза больше 128K у GPT-5.5)
  • 1M контекстное окно — увеличение в 16 раз по сравнению с 65K у DeepSeek R1
  • На 99% дешевле GPT-5.5 для рассуждений ($0.435 против $5/М вход)
  • Кэшированный ввод: $0.003625/М — экономия 99.2% для повторяющихся префиксов
  • Режим мышления: переключаемое глубокое рассуждение без дополнительных затрат
Цена входа
$1.32
per 1M tokens
Цена выхода
$1.98
per 1M tokens
Кэшированный вход
$0.022
per 1M tokens
Пакетный вход
per 1M tokens
Окно контекста: 1M
Макс. выход: 384,000 tokens
Дата обрезания знаний: 2025-06
ЗрениеВызов функцийТонкая настройкаРежим JSON

Плюсы

  • 384K макс. вывод — самый большой из доступных
  • 1M контекстное окно
  • На 99% дешевле GPT-5.5 для рассуждений

Минусы

  • Нет поддержки зрения
  • Нет тонкой настройки
  • Режим мышления добавляет накладные расходы на токены

Производительность

Скорость вывода~30 tok/s
Ограничение скорости2,000 RPM

Мультимодальность

Ввод изображенияВывод изображенияВвод аудиоВывод аудио

Бенчмарки

MMLU
88.0%
AIME 2024
85.0%
SWE-bench Verified
71.0%
MATH
82.5%

DeepSeek V4 Flash

Flagship

Сверхдешевое кодирование, общие задачи

Официальные цены

Когда использовать: Лучше всего подходит для высокообъемного кодирования и общих задач, где стоимость является основным фактором.

Ключевые улучшения

  • Самая дешевая LLM: $0.14/M вход, $0.28/M вывод
  • 1M контекст + 384K вывод — та же емкость, что у V4 Pro, за 1/3 цены
  • Двойной режим: мышление и без мышления — переключайтесь в зависимости от сложности задачи
  • Кэшированный вход: $0.0028/M — экономия 98% на системных подсказках
  • Нет зрения — только текст; используйте GPT-4.1 или Gemini для мультимодальных задач
Цена входа
$0.220
per 1M tokens
Цена выхода
$0.660
per 1M tokens
Кэшированный вход
$0.0028
per 1M tokens
Пакетный вход
per 1M tokens
Окно контекста: 1M
Макс. выход: 384,000 tokens
Дата обрезания знаний: 2025-06
ЗрениеВызов функцийТонкая настройкаРежим JSON

Плюсы

  • Самая дешевая LLM на рынке: $0.14/M вход
  • 1M контекст + 384K вывод
  • Поддерживает режимы мышления и без мышления

Минусы

  • Нет поддержки зрения
  • Качество ниже GPT-5.4 для сложных задач
  • Нет тонкой настройки

Производительность

Скорость вывода~60 tok/s
Ограничение скорости5,000 RPM

Мультимодальность

Ввод изображенияВывод изображенияВвод аудиоВывод аудио

Бенчмарки

MMLU
84.5%
HumanEval
86.0%
SWE-bench Verified
55.0%

DeepSeek V3

Flagship

Кодинг, математика, рассуждения

Официальные цены

Когда использовать: Лучший бюджетный флагман для задач с интенсивным кодингом. В 10 раз дешевле GPT-4.1 при сопоставимом качестве.

Ключевые улучшения

  • В 10 раз дешевле GPT-4.1 ($0,27 против $2/М вход) при сопоставимом кодинге
  • Доступна тонкая настройка — настройка для доменных задач кодинга
  • Кэширование подсказок: $0,07/М — экономия 74% для повторяющихся системных подсказок
  • 671B MoE параметров с 37B активными — флагманский интеллект по бюджетной цене
  • 65K контекст мал по сравнению с 1M конкурентами — обновитесь до V4 для длинного контекста
Цена входа
$0.270
per 1M tokens
Цена выхода
$1.10
per 1M tokens
Кэшированный вход
$0.070
per 1M tokens
Пакетный вход
per 1M tokens
Окно контекста: 66K
Макс. выход: 8,192 tokens
Дата обрезания знаний: 2024-07
ЗрениеВызов функцийТонкая настройкаРежим JSON

Плюсы

  • Чрезвычайно дешево для флагманского качества
  • Отличный кодинг и математика
  • Доступны тонкая настройка и кэширование

Минусы

  • Всего 65K контекст
  • Нет зрения
  • Ограниченная надежность вызова функций

Производительность

Скорость вывода~50 tok/s
Ограничение скорости3,000 RPM

Мультимодальность

Ввод изображенияВывод изображенияВвод аудиоВывод аудио

Бенчмарки

MMLU
87.1%
SWE-bench Verified
50.0%
MATH
75.0%
HumanEval
89.0%

Агенты, использующие эту модель

2

DeepSeek R1

Reasoning

Глубокие рассуждения, математические доказательства

Официальные цены

Когда использовать: Бюджетная модель рассуждений — используйте, когда стоимость o3 непомерна для математических/логических конвейеров.

Ключевые улучшения

  • В 4 раза дешевле o3 ($0,55 против $2/М вход) для сопоставимых рассуждений
  • AIME 2024: 79,8% — конкурентоспособна с o1 по математическим бенчмаркам
  • Кэширование подсказок: $0,14/М — экономия 75% для повторяющихся префиксов
  • Модель рассуждений с открытым исходным кодом — самостоятельное размещение для неограниченного использования
  • Нет вызова функций или зрения — чистые рассуждения; обновитесь до V4 Pro для инструментов
Цена входа
$0.550
per 1M tokens
Цена выхода
$2.19
per 1M tokens
Кэшированный вход
$0.140
per 1M tokens
Пакетный вход
per 1M tokens
Окно контекста: 66K
Макс. выход: 8,192 tokens
Дата обрезания знаний: 2024-07
ЗрениеВызов функцийТонкая настройкаРежим JSON

Плюсы

  • В 4 раза дешевле o3 для рассуждений
  • Сильная математика и логика
  • Хорошая экономия на кэшировании подсказок

Минусы

  • Нет вызова функций
  • Нет зрения или тонкой настройки
  • Только 65K контекста

Производительность

Скорость вывода~20 tok/s
Ограничение скорости2,000 RPM

Мультимодальность

Ввод изображенияВывод изображенияВвод аудиоВывод аудио

Бенчмарки

AIME 2024
79.8%
MATH
97.3%
GPQA
71.5%

Сравнение бок о бок

МодельУровеньВходВыходКонтекст
DeepSeek V4 ProReasoning$1.32$1.981M
DeepSeek V4 FlashFlagship$0.220$0.6601M
DeepSeek V3Flagship$0.270$1.1066K
DeepSeek R1Reasoning$0.550$2.1966K