Назад в зону разработчика

Google Модели

Изучите все 10 моделей от Google с подробными ценами, плюсами и минусами, а также рекомендациями для разработчиков.

10
Модели
$0.0000
Самая низкая входная цена
1.0M
Макс. контекст
3
Уровни качества

Быстрые рекомендации

Лучшее соотношение цены и качества: DiffusionGemma ($0.0000/1M)
Лучшее качество: Gemini 3.1 Pro

Gemini 3.7 Flash

НОВИНКАMid-tier

Coding, instruction following

Официальные цены

Когда использовать: Best pick for high-volume coding assistants, agentic pipelines and tool-calling workloads on a budget.

Ключевые улучшения

  • GA on August 13, 2026 — three weeks after Gemini 3.6 Flash
  • Priced at half of Gemini 3.6 Flash: $0.75 input / $3.75 output per 1M
  • 1,048,576-token context, 65,536-token max output
Цена входа
$0.750
per 1M tokens
Цена выхода
$3.75
per 1M tokens
Кэшированный вход
per 1M tokens
Пакетный вход
per 1M tokens
Окно контекста: 1.0M
Макс. выход: 65,536 tokens
Дата обрезания знаний: 2026-01
ЗрениеВызов функцийТонкая настройкаРежим JSONБесплатный уровень

Плюсы

  • Google's most intelligent Flash model (GA Aug 13, 2026)
  • Purpose-built for coding and agents
  • 1M context at $0.75/$3.75 — half the price of Gemini 3.6 Flash

Минусы

  • Below Pro-tier reasoning on the hardest tasks
  • Very new — ecosystem tooling still catching up

Производительность

Скорость вывода~120 tok/s
Ограничение скорости

Мультимодальность

Ввод изображенияВывод изображенияВвод аудиоВывод аудио

Gemini 3.1 Pro

Flagship

Продвинутые рассуждения, программирование

Официальные цены

Когда использовать: Лучшая модель Google для сложных рассуждений и профессиональных задач программирования.

Ключевые улучшения

  • MMLU: 89.2% — значительно улучшенные рассуждения по сравнению с Gemini 2.5 Pro
  • Контекст 1M с выводом 65K — тот же контекст, лучшее качество
  • Скидка 50% на пакетные запросы ($1/$6) — самый дешёвый флагманский пакет
  • Кэширование контекста: $0.50/M — экономия 75% для повторяющихся префиксов
  • Платный предварительный просмотр — нет бесплатного тарифа, но надёжность производственного уровня
Цена входа
$2.00
per 1M tokens
Цена выхода
$12.00
per 1M tokens
Кэшированный вход
$0.500
per 1M tokens
Пакетный вход
$1.00
per 1M tokens
Окно контекста: 1M
Макс. выход: 65,536 tokens
Дата обрезания знаний: 2025-06
ЗрениеВызов функцийТонкая настройкаРежим JSON

Плюсы

  • Контекст 1M с выводом 65K
  • Значительно улучшенные рассуждения по сравнению с 3.0
  • Скидка 50% на пакетные запросы

Минусы

  • Нет бесплатного тарифа (платный предварительный просмотр)
  • Ввод длинного контекста в 2 раза выше 200K
  • Ещё развивается

Производительность

Скорость вывода~55 tok/s
Ограничение скорости5,000 RPM

Мультимодальность

Ввод изображенияВывод изображенияВвод аудиоВывод аудио

Бенчмарки

MMLU
89.2%
SWE-bench Verified
68.0%
GPQA
74.5%

Gemini 3.5 Pro

Flagship

Сложное кодирование, продвинутая математика, глубокое рассуждение

Официальные цены

Когда использовать: Лучшая модель Google для сложного кодирования, продвинутой математики и задач глубокого рассуждения, где точность имеет наибольшее значение.

Ключевые улучшения

  • Последний флагман с улучшенным рассуждением по сравнению с 3.1 Pro
  • 1M контекст с многоуровневым ценообразованием: $1.25/$10 (≤200K), $2.50/$15 (>200K)
  • Доступен бесплатный уровень с ограничениями скорости — единственный флагман с бесплатным доступом
  • 50% скидка на пакетные запросы ($0.625/$5) — самый дешевый пакетный флагман
  • Кэширование контекста: $0.315/M — экономия 75% для повторяющихся префиксов
Цена входа
$1.25
per 1M tokens
Цена выхода
$10.00
per 1M tokens
Кэшированный вход
$0.315
per 1M tokens
Пакетный вход
$0.625
per 1M tokens
Окно контекста: 1M
Макс. выход: 65,536 tokens
Дата обрезания знаний: 2026-06
ЗрениеВызов функцийТонкая настройкаРежим JSONБесплатный уровень

Плюсы

  • 1M контекст с многоуровневым ценообразованием
  • Лучшие в своем классе бенчмарки рассуждений
  • Бесплатный уровень с ограничениями скорости
  • Доступна 50% скидка на пакетные запросы

Минусы

  • Длинный контекст (>200K) в 2 раза дороже
  • Нет поддержки тонкой настройки
  • Вывод включает токены размышлений

Производительность

Скорость вывода~50 tok/s
Ограничение скорости5,000 RPM

Мультимодальность

Ввод изображенияВывод изображенияВвод аудиоВывод аудио

Бенчмарки

MMLU
90.5%
SWE-bench Verified
72.0%
GPQA
78.0%

Агенты, использующие эту модель

4

Gemini Omni Flash

Mid-tier

Мультимодальная генерация: текст, изображение, аудио и видео

Официальные цены

Когда использовать: Лучше всего подходит для мультимодальной творческой работы, охватывающей текст, изображение, аудио и видео в одной модели.

Ключевые улучшения

  • Первая модель высшего уровня, нативно объединяющая текст, изображение, аудио и видео
  • Ввод: $1.50/M для всех модальностей (текст/изображение/видео/аудио)
  • Вывод текста: $9/M — Вывод видео: $17.50/M (~$0.10/сек при 720p)
  • Обеспечивает агентные творческие рабочие процессы и редактирование видео в реальном времени
Цена входа
$1.50
per 1M tokens
Цена выхода
$9.00
per 1M tokens
Кэшированный вход
per 1M tokens
Пакетный вход
per 1M tokens
Окно контекста: 1M
Макс. выход: 65,536 tokens
Дата обрезания знаний: 2026-06
ЗрениеВызов функцийТонкая настройкаРежим JSON

Плюсы

  • Первая нативно унифицированная модель текст/изображение/аудио/видео
  • Манипуляция видео в реальном времени
  • $1.50/M ввод для всех модальностей
  • Агентные творческие рабочие процессы

Минусы

  • Вывод видео по цене $17.50/M дорогой
  • Нет бесплатного тарифа
  • Предварительная версия — может измениться

Производительность

Скорость вывода~60 tok/s
Ограничение скорости3,000 RPM

Мультимодальность

Ввод изображенияВывод изображенияВвод аудиоВывод аудио

Gemini 3.5 Flash

Mid-tier

Быстрая, интеллектуальная генерация

Официальные цены

Когда использовать: Лучший баланс скорости и интеллекта для продакшн-приложений, требующих мультимодальных возможностей.

Ключевые улучшения

  • Передовой интеллект по средней цене — соответствует качеству Gemini 2.5 Pro
  • 1M контекст + 65K вывод за $1.50/$9 — в 8 раз дешевле флагмана
  • Доступен бесплатный тариф с ограничениями — лучшая бесплатная модель от Google
  • Кэширование контекста: $0.375/M — экономия 75% для кэшированного ввода
  • Мультимодальность (текст + зрение) на скорости flash — типичная задержка менее 1 секунды
Цена входа
$1.50
per 1M tokens
Цена выхода
$9.00
per 1M tokens
Кэшированный вход
$0.375
per 1M tokens
Пакетный вход
$0.750
per 1M tokens
Окно контекста: 1M
Макс. выход: 65,536 tokens
Дата обрезания знаний: 2025-06
ЗрениеВызов функцийТонкая настройкаРежим JSONБесплатный уровень

Плюсы

  • Передовой интеллект по средней цене
  • 1M контекст + 65K вывод
  • Бесплатный тариф с ограничениями

Минусы

  • Дороже, чем 3.1 Flash-Lite
  • Стоимость вывода $9/M значительна при масштабировании
  • Нет тонкой настройки

Производительность

Скорость вывода~95 tok/s
Ограничение скорости10,000 RPM

Мультимодальность

Ввод изображенияВывод изображенияВвод аудиоВывод аудио

Бенчмарки

MMLU
86.5%
HumanEval
85.0%
MATH
73.0%

Gemini 3.1 Flash-Lite

Lite

Задачи с высоким объемом и низкой задержкой

Официальные цены

Когда использовать: Лучшая бюджетная модель для классификации, извлечения и легкой генерации с высоким объемом.

Ключевые улучшения

  • 1M контекст за $0.25/M ввод — в 6 раз дешевле Gemini 2.5 Flash
  • 65K макс. вывод — как в Pro-уровне по цене Lite
  • Кэширование контекста: $0.0625/M — 90% экономии, лучшая ценность кэширования
  • Batch API: $0.125/$0.75 — 50% экономии для асинхронной обработки
  • Бесплатный уровень с ограничениями — безлимитное прототипирование без затрат
Цена входа
$0.250
per 1M tokens
Цена выхода
$1.50
per 1M tokens
Кэшированный вход
$0.063
per 1M tokens
Пакетный вход
$0.125
per 1M tokens
Окно контекста: 1M
Макс. выход: 65,536 tokens
Дата обрезания знаний: 2025-04
ЗрениеВызов функцийТонкая настройкаРежим JSONБесплатный уровень

Плюсы

  • 1M контекст за $0.25/M ввод — невероятная ценность
  • 65K макс. вывод
  • 90% экономии на кэшировании контекста

Минусы

  • Качество ниже 3.5 Flash для сложных задач
  • Нет тонкой настройки
  • Новая модель, менее проверенная

Производительность

Скорость вывода~130 tok/s
Ограничение скорости15,000 RPM

Мультимодальность

Ввод изображенияВывод изображенияВвод аудиоВывод аудио

Бенчмарки

MMLU
79.0%
HumanEval
74.5%

Gemini 2.5 Pro

Flagship

Сложные рассуждения, длинный контекст

Официальные цены

Когда использовать: Лучшая по соотношению цена/качество флагманская модель — контекст 1M по более низкой цене, чем GPT-4.1 или Claude Sonnet.

Ключевые улучшения

  • Самый дешевый флагманский ввод: $1.25/M — на 40% дешевле GPT-4.1
  • Окно контекста 1M с выводом 65K — самый большой вывод среди флагманов
  • Кэширование контекста: $0.315/M — экономия 75% для повторяющихся префиксов
  • Доступен бесплатный тариф — единственная флагманская модель с бесплатным доступом
  • MMLU: 85.4% — конкурентоспособна с GPT-4.1 при вдвое меньшей стоимости
Цена входа
$1.25
per 1M tokens
Цена выхода
$10.00
per 1M tokens
Кэшированный вход
$0.315
per 1M tokens
Пакетный вход
per 1M tokens
Окно контекста: 1.0M
Макс. выход: 65,536 tokens
Дата обрезания знаний: 2025-01
ЗрениеВызов функцийТонкая настройкаРежим JSONБесплатный уровень

Плюсы

  • Окно контекста 1M
  • Самый дешевый флагманский ввод по цене $1.25
  • Максимальный вывод 65K

Минусы

  • Нет пакетного API
  • Нет тонкой настройки
  • Более высокая стоимость вывода

Производительность

Скорость вывода~50 tok/s
Ограничение скорости5,000 RPM

Мультимодальность

Ввод изображенияВывод изображенияВвод аудиоВывод аудио

Бенчмарки

MMLU
85.4%
SWE-bench Verified
63.8%
MATH
72.0%

Агенты, использующие эту модель

2

Gemini 2.5 Flash

Mid-tier

Быстрая и эффективная генерация

Официальные цены

Когда использовать: Отличная ценность для продакшн-приложений — контекст в 1 млн за $0,15/1 млн входных токенов.

Ключевые улучшения

  • Тот же контекст в 1 млн, что и в Pro, по цене в 8 раз ниже ($0,15 против $1,25/млн)
  • Максимальный вывод 65 тыс. — идентично уровню Pro по объему генерации
  • Кэширование контекста: $0,0375/млн — экономия 97% для кэшированных префиксов
  • Бесплатный уровень с щедрыми лимитами — готов к продакшну без затрат
  • Задержка менее секунды — самая быстрая модель Google для приложений реального времени
Цена входа
$0.150
per 1M tokens
Цена выхода
$0.600
per 1M tokens
Кэшированный вход
$0.037
per 1M tokens
Пакетный вход
per 1M tokens
Окно контекста: 1.0M
Макс. выход: 65,536 tokens
Дата обрезания знаний: 2025-01
ЗрениеВызов функцийТонкая настройкаРежим JSONБесплатный уровень

Плюсы

  • Тот же контекст в 1 млн, что и в Pro, по цене в 8 раз ниже
  • Максимальный вывод 65 тыс.
  • Лучшая экономия на кэшированных входных данных

Минусы

  • Нет пакетного API
  • Качество ниже Pro для сложных задач
  • Нет тонкой настройки

Производительность

Скорость вывода~100 tok/s
Ограничение скорости10,000 RPM

Мультимодальность

Ввод изображенияВывод изображенияВвод аудиоВывод аудио

Бенчмарки

MMLU
83.0%
HumanEval
82.5%
MATH
68.0%

Агенты, использующие эту модель

4

Gemini 2.0 Flash

Lite

Сверхбыстрый, низкая стоимость

Официальные цены

Когда использовать: Лучший бюджетный вариант для высокообъемного извлечения, классификации и тонко настроенных моделей.

Ключевые улучшения

  • Самая дешевая модель с контекстом 1M: $0.10/M ввод — самая низкая на рынке
  • Единственная легкая модель с тонкой настройкой + зрение — полный набор функций
  • Кэширование контекста: $0.025/M — экономия 97.5% для повторяющихся префиксов
  • Максимальный вывод 8K — низкий, обновитесь до 2.5 Flash для вывода 65K
  • Поддержка тонкой настройки — лучшее для доменно-специфичных моделей классификации
Цена входа
$0.100
per 1M tokens
Цена выхода
$0.400
per 1M tokens
Кэшированный вход
$0.025
per 1M tokens
Пакетный вход
per 1M tokens
Окно контекста: 1.0M
Макс. выход: 8,192 tokens
Дата обрезания знаний: 2024-08
ЗрениеВызов функцийТонкая настройкаРежим JSONБесплатный уровень

Плюсы

  • Самая дешевая модель на рынке с контекстом 1M
  • Единственная легкая модель с тонкой настройкой + зрение
  • Полный набор функций

Минусы

  • Максимальный вывод 8K — низкий
  • Устаревшая дата обрезания знаний
  • Качество ниже 2.5 Flash

Производительность

Скорость вывода~140 tok/s
Ограничение скорости15,000 RPM

Мультимодальность

Ввод изображенияВывод изображенияВвод аудиоВывод аудио

Бенчмарки

MMLU
78.5%
HumanEval
75.0%
MATH
62.0%

DiffusionGemma

Mid-tier

Быстрая локальная генерация текста, параллельное декодирование

Официальные цены

Когда использовать: Когда вам нужна быстрая локальная генерация текста на потребительских GPU и вы готовы пожертвовать качеством ради 4-кратной скорости.

Ключевые улучшения

  • 26B общих MoE, 3,8B активных — работает на одном GPU с 24 ГБ
  • 4-кратное ускорение генерации текста с помощью диффузионного параллельного декодирования
  • Открытый исходный код Apache 2.0 — развертывайте где угодно, дорабатывайте свободно
  • Двунаправленный контекст обеспечивает самокоррекцию
  • Компромисс: более низкие показатели бенчмарков по сравнению со стандартной Gemma 4
Цена входа
$0.0000
per 1M tokens
Цена выхода
$0.0000
per 1M tokens
Кэшированный вход
per 1M tokens
Пакетный вход
per 1M tokens
Окно контекста: 262K
Макс. выход: 32,768 tokens
Дата обрезания знаний: 2025-06
ЗрениеВызов функцийТонкая настройкаРежим JSONБесплатный уровень

Плюсы

  • В 4 раза быстрее стандартной Gemma благодаря параллельному диффузионному декодированию
  • 26B MoE с всего 3,8B активных параметров — помещается в 24 ГБ VRAM
  • Открытый исходный код под лицензией Apache 2.0 — полные веса доступны
  • Двунаправленный контекст для самокоррекции

Минусы

  • Уступает стандартной Gemma 4 по всем бенчмаркам
  • Нет поддержки зрения или аудио
  • Нет вызова функций
  • Экспериментальная — не для критически важных рабочих нагрузок

Производительность

Скорость вывода~200 tok/s
Ограничение скорости

Мультимодальность

Ввод изображенияВывод изображенияВвод аудиоВывод аудио

Бенчмарки

MMLU
72.0%
HumanEval
68.0%

Сравнение бок о бок

МодельУровеньВходВыходКонтекст
Gemini 3.7 FlashMid-tier$0.750$3.751.0M
Gemini 3.1 ProFlagship$2.00$12.001M
Gemini 3.5 ProFlagship$1.25$10.001M
Gemini Omni FlashMid-tier$1.50$9.001M
Gemini 3.5 FlashMid-tier$1.50$9.001M
Gemini 3.1 Flash-LiteLite$0.250$1.501M
Gemini 2.5 ProFlagship$1.25$10.001.0M
Gemini 2.5 FlashMid-tier$0.150$0.6001.0M
Gemini 2.0 FlashLite$0.100$0.4001.0M
DiffusionGemmaMid-tier$0.0000$0.0000262K