Google Модели
Изучите все 10 моделей от Google с подробными ценами, плюсами и минусами, а также рекомендациями для разработчиков.
Быстрые рекомендации
Gemini 3.7 Flash
НОВИНКАMid-tierCoding, instruction following
Когда использовать: Best pick for high-volume coding assistants, agentic pipelines and tool-calling workloads on a budget.
Ключевые улучшения
- ◆GA on August 13, 2026 — three weeks after Gemini 3.6 Flash
- ◆Priced at half of Gemini 3.6 Flash: $0.75 input / $3.75 output per 1M
- ◆1,048,576-token context, 65,536-token max output
Плюсы
- Google's most intelligent Flash model (GA Aug 13, 2026)
- Purpose-built for coding and agents
- 1M context at $0.75/$3.75 — half the price of Gemini 3.6 Flash
Минусы
- Below Pro-tier reasoning on the hardest tasks
- Very new — ecosystem tooling still catching up
Производительность
Мультимодальность
Gemini 3.1 Pro
FlagshipПродвинутые рассуждения, программирование
Когда использовать: Лучшая модель Google для сложных рассуждений и профессиональных задач программирования.
Ключевые улучшения
- ◆MMLU: 89.2% — значительно улучшенные рассуждения по сравнению с Gemini 2.5 Pro
- ◆Контекст 1M с выводом 65K — тот же контекст, лучшее качество
- ◆Скидка 50% на пакетные запросы ($1/$6) — самый дешёвый флагманский пакет
- ◆Кэширование контекста: $0.50/M — экономия 75% для повторяющихся префиксов
- ◆Платный предварительный просмотр — нет бесплатного тарифа, но надёжность производственного уровня
Плюсы
- Контекст 1M с выводом 65K
- Значительно улучшенные рассуждения по сравнению с 3.0
- Скидка 50% на пакетные запросы
Минусы
- Нет бесплатного тарифа (платный предварительный просмотр)
- Ввод длинного контекста в 2 раза выше 200K
- Ещё развивается
Производительность
Мультимодальность
Бенчмарки
Gemini 3.5 Pro
FlagshipСложное кодирование, продвинутая математика, глубокое рассуждение
Когда использовать: Лучшая модель Google для сложного кодирования, продвинутой математики и задач глубокого рассуждения, где точность имеет наибольшее значение.
Ключевые улучшения
- ◆Последний флагман с улучшенным рассуждением по сравнению с 3.1 Pro
- ◆1M контекст с многоуровневым ценообразованием: $1.25/$10 (≤200K), $2.50/$15 (>200K)
- ◆Доступен бесплатный уровень с ограничениями скорости — единственный флагман с бесплатным доступом
- ◆50% скидка на пакетные запросы ($0.625/$5) — самый дешевый пакетный флагман
- ◆Кэширование контекста: $0.315/M — экономия 75% для повторяющихся префиксов
Плюсы
- 1M контекст с многоуровневым ценообразованием
- Лучшие в своем классе бенчмарки рассуждений
- Бесплатный уровень с ограничениями скорости
- Доступна 50% скидка на пакетные запросы
Минусы
- Длинный контекст (>200K) в 2 раза дороже
- Нет поддержки тонкой настройки
- Вывод включает токены размышлений
Производительность
Мультимодальность
Бенчмарки
Агенты, использующие эту модель
4Gemini Omni Flash
Mid-tierМультимодальная генерация: текст, изображение, аудио и видео
Когда использовать: Лучше всего подходит для мультимодальной творческой работы, охватывающей текст, изображение, аудио и видео в одной модели.
Ключевые улучшения
- ◆Первая модель высшего уровня, нативно объединяющая текст, изображение, аудио и видео
- ◆Ввод: $1.50/M для всех модальностей (текст/изображение/видео/аудио)
- ◆Вывод текста: $9/M — Вывод видео: $17.50/M (~$0.10/сек при 720p)
- ◆Обеспечивает агентные творческие рабочие процессы и редактирование видео в реальном времени
Плюсы
- Первая нативно унифицированная модель текст/изображение/аудио/видео
- Манипуляция видео в реальном времени
- $1.50/M ввод для всех модальностей
- Агентные творческие рабочие процессы
Минусы
- Вывод видео по цене $17.50/M дорогой
- Нет бесплатного тарифа
- Предварительная версия — может измениться
Производительность
Мультимодальность
Gemini 3.5 Flash
Mid-tierБыстрая, интеллектуальная генерация
Когда использовать: Лучший баланс скорости и интеллекта для продакшн-приложений, требующих мультимодальных возможностей.
Ключевые улучшения
- ◆Передовой интеллект по средней цене — соответствует качеству Gemini 2.5 Pro
- ◆1M контекст + 65K вывод за $1.50/$9 — в 8 раз дешевле флагмана
- ◆Доступен бесплатный тариф с ограничениями — лучшая бесплатная модель от Google
- ◆Кэширование контекста: $0.375/M — экономия 75% для кэшированного ввода
- ◆Мультимодальность (текст + зрение) на скорости flash — типичная задержка менее 1 секунды
Плюсы
- Передовой интеллект по средней цене
- 1M контекст + 65K вывод
- Бесплатный тариф с ограничениями
Минусы
- Дороже, чем 3.1 Flash-Lite
- Стоимость вывода $9/M значительна при масштабировании
- Нет тонкой настройки
Производительность
Мультимодальность
Бенчмарки
Gemini 3.1 Flash-Lite
LiteЗадачи с высоким объемом и низкой задержкой
Когда использовать: Лучшая бюджетная модель для классификации, извлечения и легкой генерации с высоким объемом.
Ключевые улучшения
- ◆1M контекст за $0.25/M ввод — в 6 раз дешевле Gemini 2.5 Flash
- ◆65K макс. вывод — как в Pro-уровне по цене Lite
- ◆Кэширование контекста: $0.0625/M — 90% экономии, лучшая ценность кэширования
- ◆Batch API: $0.125/$0.75 — 50% экономии для асинхронной обработки
- ◆Бесплатный уровень с ограничениями — безлимитное прототипирование без затрат
Плюсы
- 1M контекст за $0.25/M ввод — невероятная ценность
- 65K макс. вывод
- 90% экономии на кэшировании контекста
Минусы
- Качество ниже 3.5 Flash для сложных задач
- Нет тонкой настройки
- Новая модель, менее проверенная
Производительность
Мультимодальность
Бенчмарки
Gemini 2.5 Pro
FlagshipСложные рассуждения, длинный контекст
Когда использовать: Лучшая по соотношению цена/качество флагманская модель — контекст 1M по более низкой цене, чем GPT-4.1 или Claude Sonnet.
Ключевые улучшения
- ◆Самый дешевый флагманский ввод: $1.25/M — на 40% дешевле GPT-4.1
- ◆Окно контекста 1M с выводом 65K — самый большой вывод среди флагманов
- ◆Кэширование контекста: $0.315/M — экономия 75% для повторяющихся префиксов
- ◆Доступен бесплатный тариф — единственная флагманская модель с бесплатным доступом
- ◆MMLU: 85.4% — конкурентоспособна с GPT-4.1 при вдвое меньшей стоимости
Плюсы
- Окно контекста 1M
- Самый дешевый флагманский ввод по цене $1.25
- Максимальный вывод 65K
Минусы
- Нет пакетного API
- Нет тонкой настройки
- Более высокая стоимость вывода
Производительность
Мультимодальность
Бенчмарки
Агенты, использующие эту модель
2Gemini 2.5 Flash
Mid-tierБыстрая и эффективная генерация
Когда использовать: Отличная ценность для продакшн-приложений — контекст в 1 млн за $0,15/1 млн входных токенов.
Ключевые улучшения
- ◆Тот же контекст в 1 млн, что и в Pro, по цене в 8 раз ниже ($0,15 против $1,25/млн)
- ◆Максимальный вывод 65 тыс. — идентично уровню Pro по объему генерации
- ◆Кэширование контекста: $0,0375/млн — экономия 97% для кэшированных префиксов
- ◆Бесплатный уровень с щедрыми лимитами — готов к продакшну без затрат
- ◆Задержка менее секунды — самая быстрая модель Google для приложений реального времени
Плюсы
- Тот же контекст в 1 млн, что и в Pro, по цене в 8 раз ниже
- Максимальный вывод 65 тыс.
- Лучшая экономия на кэшированных входных данных
Минусы
- Нет пакетного API
- Качество ниже Pro для сложных задач
- Нет тонкой настройки
Производительность
Мультимодальность
Бенчмарки
Gemini 2.0 Flash
LiteСверхбыстрый, низкая стоимость
Когда использовать: Лучший бюджетный вариант для высокообъемного извлечения, классификации и тонко настроенных моделей.
Ключевые улучшения
- ◆Самая дешевая модель с контекстом 1M: $0.10/M ввод — самая низкая на рынке
- ◆Единственная легкая модель с тонкой настройкой + зрение — полный набор функций
- ◆Кэширование контекста: $0.025/M — экономия 97.5% для повторяющихся префиксов
- ◆Максимальный вывод 8K — низкий, обновитесь до 2.5 Flash для вывода 65K
- ◆Поддержка тонкой настройки — лучшее для доменно-специфичных моделей классификации
Плюсы
- Самая дешевая модель на рынке с контекстом 1M
- Единственная легкая модель с тонкой настройкой + зрение
- Полный набор функций
Минусы
- Максимальный вывод 8K — низкий
- Устаревшая дата обрезания знаний
- Качество ниже 2.5 Flash
Производительность
Мультимодальность
Бенчмарки
DiffusionGemma
Mid-tierБыстрая локальная генерация текста, параллельное декодирование
Когда использовать: Когда вам нужна быстрая локальная генерация текста на потребительских GPU и вы готовы пожертвовать качеством ради 4-кратной скорости.
Ключевые улучшения
- ◆26B общих MoE, 3,8B активных — работает на одном GPU с 24 ГБ
- ◆4-кратное ускорение генерации текста с помощью диффузионного параллельного декодирования
- ◆Открытый исходный код Apache 2.0 — развертывайте где угодно, дорабатывайте свободно
- ◆Двунаправленный контекст обеспечивает самокоррекцию
- ◆Компромисс: более низкие показатели бенчмарков по сравнению со стандартной Gemma 4
Плюсы
- В 4 раза быстрее стандартной Gemma благодаря параллельному диффузионному декодированию
- 26B MoE с всего 3,8B активных параметров — помещается в 24 ГБ VRAM
- Открытый исходный код под лицензией Apache 2.0 — полные веса доступны
- Двунаправленный контекст для самокоррекции
Минусы
- Уступает стандартной Gemma 4 по всем бенчмаркам
- Нет поддержки зрения или аудио
- Нет вызова функций
- Экспериментальная — не для критически важных рабочих нагрузок
Производительность
Мультимодальность
Бенчмарки
Сравнение бок о бок
| Модель | Уровень | Вход | Выход | Контекст |
|---|---|---|---|---|
| Gemini 3.7 Flash | Mid-tier | $0.750 | $3.75 | 1.0M |
| Gemini 3.1 Pro | Flagship | $2.00 | $12.00 | 1M |
| Gemini 3.5 Pro | Flagship | $1.25 | $10.00 | 1M |
| Gemini Omni Flash | Mid-tier | $1.50 | $9.00 | 1M |
| Gemini 3.5 Flash | Mid-tier | $1.50 | $9.00 | 1M |
| Gemini 3.1 Flash-Lite | Lite | $0.250 | $1.50 | 1M |
| Gemini 2.5 Pro | Flagship | $1.25 | $10.00 | 1.0M |
| Gemini 2.5 Flash | Mid-tier | $0.150 | $0.600 | 1.0M |
| Gemini 2.0 Flash | Lite | $0.100 | $0.400 | 1.0M |
| DiffusionGemma | Mid-tier | $0.0000 | $0.0000 | 262K |