Игорь Градов
Игорь Градов
5 мин
ai

Gemini 3.6 Flash тратит на 17% меньше токенов: Google снижает цену ИИ для разработчиков

Google 28 июля представил Gemini 3.6 Flash, обновлённую языковую модель для разработчиков, которая тратит на 17% меньше токенов (единиц текста, по которым считается стоимость запроса) и стоит дешевле предшественника.

Gemini 3.6 Flash тратит на 17% меньше токенов: Google снижает цену ИИ для разработчиков
Почему это важно

Gemini 3.6 Flash снижает расход токенов при тех же и лучших результатах, а цена за миллион выходных токенов упала по сравнению с предыдущей версией, это напрямую уменьшает бюджет на API для любого продукта, работающего на модели Google.

Вместе с Gemini 3.6 Flash Google выпустил ещё две модели: 3.5 Flash-Lite для задач с высокой скоростью и 3.5 Flash Cyber для поиска уязвимостей в коде. Одновременно компания сообщила, что Gemini 3.5 Pro проходит тестирование с партнёрами, а команда уже начала обучение следующего поколения, Gemini 4. Источник анонса: блог Google.

Что Когда Кто выпустил Цена
Gemini 3.6 Flash 28 июля 2025 года Google $1,50 за 1 млн входных токенов, $7,50 за 1 млн выходных токенов
Gemini 3.5 Flash-Lite 28 июля 2025 года Google $0,30 за 1 млн входных токенов, $2,50 за 1 млн выходных токенов
Gemini 3.5 Flash Cyber (в CodeMender) 28 июля 2025 года Google цену не раскрыли

Что Gemini 3.6 Flash делает лучше предшественника?

  • Экономия токенов. По данным Artificial Analysis Index, модель расходует на 17% меньше выходных токенов, чем Gemini 3.5 Flash. На бенчмарке DeepSWE от Datacurve экономия доходит до 65%.
  • Код и инженерные задачи. Результат на DeepSWE вырос с 37% до 49%, на MLE Bench (задачи машинного обучения) с 49,7% до 63,9%.
  • Работа с экраном (computer use). На OSWorld-Verified показатель поднялся с 78,4% до 83,0%. Функция встроена как инструмент в Gemini API.
  • Анализ документов и знаний. На GDPval-AA v2 результат вырос с 1349 до 1421. Компании Hebbia и Harvey, по данным Google, отмечают улучшение в разборе документов, графиков и подготовке отчётов.
  • Безопасность. Модель получила усиленную защиту от попыток обхода ограничений (jailbreak) в областях химических, биологических, радиологических и ядерных рисков, при этом количество ложных отказов на полезные запросы снижено.

Что за Flash-Lite и Flash Cyber?

Gemini 3.5 Flash-Lite рассчитана на задачи, где важна скорость. По замерам Artificial Analysis, модель выдаёт 350 выходных токенов в секунду. На Terminal-Bench 2.1 результат вырос с 31% до 54% по сравнению с предыдущим Flash-Lite.

Примечательно, что Flash-Lite во многих агентных (агентный, когда ИИ-агент сам выполняет цепочку шагов без ручного контроля) и кодовых тестах обгоняет даже более старшую модель Gemini 3 Flash. Например, SWE-Bench Pro: 54,2% против 49,6%.

Gemini 3.5 Flash Cyber работает внутри агента CodeMender и специализируется на поиске и исправлении уязвимостей в коде. Это связка специализированной модели и инфраструктуры агента, а не отдельный продукт для конечного пользователя.

Как попробовать?

  1. Откройте Google AI Studio по адресу aistudio.google.com и выберите Gemini 3.6 Flash в списке моделей. Для доступа нужен аккаунт Google.
  2. Если вы разработчик, подключите модель через Gemini API, указав идентификатор 3.6 Flash. Цены: $1,50 за миллион входных токенов, $7,50 за миллион выходных.
  3. Для быстрых и дешёвых задач (массовая обработка документов, агентный поиск) переключитесь на 3.5 Flash-Lite: $0,30 и $2,50 за миллион токенов соответственно.

Сравнение с доступными в России аналогами

Прямого аналога Gemini 3.6 Flash среди российских моделей нет: YandexGPT и GigaChat не публикуют стоимость за токены в том же формате и не проходят те же бенчмарки. Но российским пользователям стоит учитывать практический момент: доступ к Gemini API из РФ может требовать VPN и оплаты в валюте, тогда как YandexGPT и GigaChat работают без ограничений по региону, с рублёвыми тарифами и российской поддержкой. Для задач, где критична локализация и гарантированный доступ, они остаются базовым вариантом.

Что это значит для вас по ролям?

Автору на Дзене. Если вы используете API для генерации черновиков, обработки источников или подготовки иллюстраций через мультимодальные (способные работать с текстом, картинками, видео одновременно) запросы, переход с 3.5 Flash на Gemini 3.6 Flash сократит количество потраченных токенов при том же результате. Это значит: тот же объём работы за меньшие деньги.

Маркетологу. Снижение стоимости токенов на 17% и более меняет экономику автоматизированных воронок, чат-ботов и массовой обработки лидов. Пересчитайте unit-экономику ваших ИИ-инструментов с новыми ценами.

Предпринимателю в РФ. Доступ к API возможен, но с оговорками по оплате и маршрутизации трафика. Если ваш продукт работает на Gemini 3.5 Flash, протестируйте 3.6 Flash на тех же задачах: по данным Google, модель выполняет их за меньшее число шагов и вызовов инструментов, что снижает и время, и стоимость.

Мнение редакции dzen.guru

Google не делает громких заявлений о «прорыве», и это честнее, чем обычно. Gemini 3.6 Flash, это инкрементальное обновление, где главный выигрыш не в качестве ответов (хотя бенчмарки подросли), а в экономике: модель стала тратить меньше токенов на ту же работу. Для тех, кто платит за API в продакшене, разница между 17% и 65% экономии, это реальные деньги. Я бы рекомендовал не переключаться вслепую, а прогнать свои рабочие промпты (текст-инструкция для модели) через обе версии и сравнить расход токенов на реальных задачах. Оговорка: все бенчмарки, которые приводит Google, измерены на их условиях, независимых сравнений пока нет.

Частые вопросы

Gemini 3.6 Flash заменяет 3.5 Flash или работает параллельно?

По информации из анонса Google, обе модели доступны одновременно. Gemini 3.6 Flash позиционируется как прямое обновление, но 3.5 Flash и 3.5 Flash-Lite продолжают работать для задач, где нужна максимальная скорость или минимальная цена.

Можно ли пользоваться Gemini 3.6 Flash из России?

Google AI Studio и Gemini API формально доступны, но из РФ могут потребоваться VPN и оплата в иностранной валюте. Гарантированной российской поддержки нет. Для задач с гарантированным доступом стоит держать в резерве YandexGPT или GigaChat.

Когда выйдет Gemini 4?

Google сообщил, что начал обучение Gemini 4 и назвал его «самым амбициозным» на данный момент. Конкретную дату релиза компания не назвала.

Поделиться:TelegramVK
Игорь Градов
Игорь Градов

Основатель dzen.guru. Эксперт по монетизации и продвижению на Дзен. Автор курса «Старт на Дзен 2026».

Комментарии

Читайте также

Музыка нейросети заняла больше 50% загрузок Deezer: выплаты живым артистам под угрозой
ai

Музыка нейросети заняла больше 50% загрузок Deezer: выплаты живым артистам под угрозой

Стриминговый сервис Deezer объявил, что больше половины треков, загружаемых на платформу каждый день, теперь создана нейросетями, и впервые предложил…

5 мин
ai

OpenAI дала ChatGPT для бизнеса бесплатно на год: экономия до $15 000 для команд до 50 человек

OpenAI 4 июня 2025 года запустила бесплатную программу ChatGPT для малого бизнеса, дав компаниям с командой до 50 человек доступ к платным функциям без…

4 мин
Google выпустила три Gemini модели, но флагман снова задерживается: конкуренты уходят вперёд
ai

Google выпустила три Gemini модели, но флагман снова задерживается: конкуренты уходят вперёд

Google выпустила сразу три модели Gemini, но ни одна из них не та, которую ждали: флагманская Gemini 3.5 Pro, обещанная ещё в мае, снова откладывается на фоне…

5 мин