Gemini AI Ru Получить доступДоступ

Модели Gemini

В линейке Gemini одновременно семь моделей: быстрые Flash и Flash-Lite, 3.1 Pro, Deep Think и отдельные модели под картинки и видео. Разбираем, чем они отличаются на практике и во сколько обходятся в API.

Линейка целиком

МодельСильная сторонаБесплатный уровень APIЦена за 1 млн токенов
Gemini 3.7 Flash Агентные задачи на потоке, самая свежая Flash Есть $0,75 вход / $3,75 выход
Gemini 3.6 Flash Модель по умолчанию в бесплатном приложении Есть $0,75 вход / $3,75 выход
Gemini 3.5 Flash Предыдущее поколение, стабильные ответы Есть $1,50 вход / $9 выход
Gemini 3.5 Flash-Lite Массовые однотипные запросы Есть $0,30 вход / $2,50 выход
Gemini 3.1 Flash-Lite Самая дешёвая в линейке Есть $0,25 вход / $1,50 выход
Gemini 3.1 Pro Длинные рассуждения, код, аналитика Нет $2 вход / $12 выход
Gemini 3.1 Deep Think Наука, инженерия, задачи с долгим обдумыванием Нет Открывается подпиской Google AI Ultra

Flash: скорость и цена

Flash отвечает почти мгновенно и стоит дешевле остальных. Это модель для повседневного: письма, переводы, разбор счёта на фотографии, короткие сводки по документу. В бесплатном приложении по умолчанию работает 3.6 Flash, и большинство пользователей других моделей не включает вовсе.

Flash-Lite — та же логика, доведённая до предела экономии. Она заметно проще в рассуждениях, зато миллион входных токенов стоит четверть доллара. На потоке однотипных операций — разметка обращений, классификация писем, короткие ответы в поддержке — разница в счёте выходит кратной.

У всех Flash есть бесплатный уровень в API с ограничением по частоте запросов, поэтому прототип собирают, не открывая кошелёк.

Pro и Deep Think: когда нужна глубина

3.1 Pro берёт задачи, где ответ собирается из нескольких шагов: разложить договор по рискам, найти ошибку в чужом коде, свести отчёт из пяти источников. Она думает дольше Flash и стоит дороже — $2 за миллион входных токенов против $0,75.

Deep Think идёт ещё дальше: модель тратит на обдумывание заметно больше времени и рассчитана на исследовательские задачи. В приложении она открывается подпиской Google AI Ultra, отдельной строки в прайсе API у неё нет.

В приложении модель переключается вручную — выпадающим списком над полем ввода. Бесплатный аккаунт получает ограниченное число обращений к Pro в сутки, после чего диалог продолжается на Flash.

Как это выглядит в счёте

Разбор одного стостраничного договора — примерно 150 тысяч входных токенов.

  • 3.1 Flash-Lite — около $0,04
  • 3.7 Flash — около $0,11
  • 3.1 Pro — около $0,30

Расчёт по ставкам входных токенов из прайса API; выходные токены считаются отдельно и зависят от длины ответа.

Картинки, видео и звук

Nano Banana Pro

Рисует по описанию и правит готовые изображения репликами в том же диалоге. Работает и без подписки, лимиты растут на платных планах.

Подробнее про картинки

Veo 3.1

Генерация видео. Расходует кредиты Google Flow: 200 на Plus, 1000 на Pro, 10 000–25 000 на Ultra.

Gemini Embedding

Векторное представление текста для поиска по своей базе. В API — $0,15 за миллион токенов, у второй версии тексты идут по $0,20, изображения по $0,45.

Какую модель включать

  • Письма, переводы, короткие сводки. 3.6 или 3.7 Flash — разницы в качестве на таких задачах почти нет, а ответ приходит быстрее.
  • Договор, отчёт, длинный код. 3.1 Pro: на многошаговых рассуждениях Flash начинает терять детали и путать нумерацию пунктов.
  • Поток одинаковых операций в своём продукте. Flash-Lite, дальше смотреть по качеству: если модель ошибается чаще допустимого, поднимать до Flash.
  • Исследование или сложная инженерная задача. Deep Think на Ultra, если готовы ждать ответ дольше.

Все модели Gemini в одном окне

Syntx открывает доступ к моделям Gemini из России: без смены страны аккаунта, с оплатой российской картой и русским интерфейсом.