Gemini 3.6 Flash и две новые модели Google: цена и доступность

Google выпустила Gemini 3.6 Flash и 3.5 Flash-Lite, а также показала закрытую Flash Cyber. Сравниваем цены, доступность и ограничения.

Официальная обложка Google с названиями Gemini 3.6 Flash, 3.5 Flash-Lite и 3.5 Flash Cyber

По состоянию на 21 июля 2026 года Gemini 3.6 Flash стала новой производственной моделью Google для кода, агентных циклов и мультимодальных задач. Компания сохранила цену входа на уровне Gemini 3.5 Flash, снизила цену выхода и одновременно выпустила более дешёвую Gemini 3.5 Flash-Lite. Третья новинка, Gemini 3.5 Flash Cyber, предназначена для поиска уязвимостей и пока не выходит в публичный Gemini API.

Для разработчиков в анонсе важнее не новый номер версии, а экономика полного задания. Google обещает меньше лишних рассуждений, повторных вызовов инструментов и выходных токенов. Ниже разбираем подтверждённые цены, доступность и ограничения, а заявления о производительности отделяем от независимо проверяемых данных.

Что Google выпустила 21 июля

Две массовые модели получили стабильные идентификаторы gemini-3.6-flash и gemini-3.5-flash-lite. Обе имеют статус GA и готовы для производственных систем. Flash Cyber устроена иначе: это специальная версия поверх 3.5 Flash, которую Google DeepMind планирует выдавать правительствам и доверенным партнёрам через CodeMender.

МодельСтатус и доступStandard API, $ за 1 млн токеновОсновная задачаКлючевое ограничениеИсточник
gemini-3.6-flashGA; Gemini API, AI Studio, Android Studio, Gemini app и корпоративные продукты1,50 вход / 7,50 выходСложные агентные циклы, код и мультимодальный анализЗаявления о росте качества основаны на тестах Google и отдельных внешних оценкахкарточка модели
gemini-3.5-flash-liteGA; Gemini API, AI Studio, Android Studio и Gemini app, развёртывание в Search0,30 вход / 2,50 выходВысокопоточная обработка, извлечение данных и подагентыОфициальные страницы расходятся в статусе Computer Useруководство по новым моделям
Gemini 3.5 Flash CyberОграниченный пилот через CodeMender для правительств и доверенных партнёровНе опубликованаПоиск, проверка и исправление уязвимостейНет общедоступного endpoint в Gemini APIанонс DeepMind
gemini-3.5-flashСтабильная модель; Google предлагает миграцию на 3.6 Flash1,50 вход / 9,00 выходБаза для сравнения с новым релизомВыходные токены стоят дороже, чем у 3.6 Flashстраница цен

Цены в таблице актуальны на 21 июля 2026 года и относятся к стандартному платному API. Бесплатный уровень, пакетная обработка, Flex и Priority тарифицируются отдельно. Для агентной системы сравнивать надо итоговую стоимость задания, а не только цену миллиона токенов.

Чем Gemini 3.6 Flash отличается от Gemini 3.5 Flash

Главное подтверждённое изменение: цена выхода $7,50 вместо $9 за 1 млн токенов, то есть на 16,7% ниже. Вход остаётся на уровне $1,50. Обе модели используют контекст до 1 048 576 токенов и могут вернуть до 65 536 токенов за ответ.

Google также пишет, что новая модель делает меньше промежуточных шагов, реже зацикливается и вызывает меньше инструментов в многошаговых заданиях. В Artificial Analysis Index она использовала на 17% меньше выходных токенов, а в отдельных тестах DeepSWE экономия доходила до 65%. Эти проценты нельзя переносить на любой продукт: один относится к конкретному индексу, второй — к отдельному тесту программных агентов.

Официальный график Google с результатами Gemini 3.6 Flash на DeepSWE, MLE-Bench, GDPval-AA и OSWorld-Verified
Google сравнивает 3.6 Flash с 3.5 Flash и 3.1 Pro на четырёх тестах. Это данные поставщика, а не универсальный рейтинг моделей. Источник: Google.

Экономию лучше проверять на своём наборе заданий через обе версии. Считайте четыре показателя: успешность, задержку, число вызовов инструментов и суммарные входные с выходными токенами. Более дешёвый выход не спасёт сценарий, если агент чаще повторяет шаги или требует ручной доработки.

Gemini 3.5 Flash-Lite для потока простых задач

Flash-Lite стоит в пять раз дешевле 3.6 Flash по входу и в три раза по выходу. Google называет её моделью для извлечения данных из документов, разбора таблиц, маршрутизации, классификации и работы подагентов. В анонсе компания ссылается на измерение Artificial Analysis в 350 выходных токенов в секунду.

Такая модель подходит не для роли единственного «мозга» системы, а для большого числа коротких операций. Старшая 3.6 Flash может строить план, а Flash-Lite параллельно разбирать чеки, документы или результаты поиска. Этот подход совпадает с тем, как Google развивает Managed Agents в Gemini API: стоимость подагентов становится частью архитектуры, а не примечанием в тарифах.

Официальный график Google со сравнением Gemini 3.5 Flash-Lite и 3.1 Flash-Lite на Terminal-bench и GDPval-AA
Google показывает прирост Flash-Lite в агентном программировании и работе со знаниями. Сравнение подготовлено самим поставщиком. Источник: Google.

Где доступны новые модели

Gemini 3.6 Flash и 3.5 Flash-Lite доступны разработчикам через Gemini API, Google AI Studio и Android Studio. Первая модель также пришла в Antigravity. Для компаний Google добавила обе версии в Gemini Enterprise Agent Platform; 3.6 Flash доступна и в Gemini Enterprise app.

Пользовательские версии появились в приложении Gemini; Flash-Lite дополнительно разворачивается в Google Search. Суть различия проста: название в приложении не гарантирует тот же набор инструментов, лимитов и настроек, что у стабильного API-идентификатора.

Предыдущая Gemini 3.5 Flash, представленная на Google I/O 2026, остаётся в документации как стабильная модель. Однако руководство Google уже указывает 3.6 Flash как путь миграции для 3.5 Flash, Gemini 3 Flash Preview и Gemini 3.1 Pro.

В API появились несовместимые изменения

Вместе с релизом Google объявила устаревшими параметры temperature, top_p и top_k для новых моделей. Сейчас API их игнорирует, а в будущих версиях обещает отвечать ошибкой 400. Предзаполненный ход модели в конце диалога тоже больше не поддерживается. Командам, которые подталкивали ответ префиксом вроде Translation:, придётся перенести требование в системную инструкцию или structured outputs.

Есть и менее приятная проблема. Руководство по миграции пишет, что обе массовые модели поддерживают полный набор встроенных инструментов, включая Computer Use. А отдельная карточка Gemini 3.5 Flash-Lite, обновлённая в тот же день, показывает Computer use: Not supported. В анонсе Google функция снова названа встроенной. Пока документация не согласована, проверяйте конкретный API и поверхность доступа перед тем, как закладывать управление интерфейсом в архитектуру. Для контекста у нас есть отдельный разбор Computer Use в Gemini 3.5 Flash.

Gemini 3.5 Flash Cyber остаётся закрытой

Flash Cyber построена поверх 3.5 Flash и дообучена искать, подтверждать и исправлять уязвимости. CodeMender вызывает несколько таких моделей как подагентов, а затем собирает единый отчёт. DeepMind утверждает, что в тесте на движке V8 новая версия нашла 55 подтверждённых уникальных проблем против 47 у обычной 3.5 Flash и 36 у Claude Opus 4.6.

Сравнение требует осторожности: методику и запуск контролировала Google, а в других тестах поставщики сообщали результаты самостоятельно. Доступ тоже намеренно ограничен. Пилот должен начаться через CodeMender для правительств и доверенных партнёров; публичной цены и обычного API-вызова нет.

Gemini 3.5 Pro всё ещё тестируется

Google не выпустила Gemini 3.5 Pro вместе с тремя Flash-моделями. В официальном анонсе сказано только, что версия тестируется с партнёрами и станет широко доступна, когда будет готова. Новой даты компания не назвала. Одновременно Google подтвердила начало предварительного обучения Gemini 4, но без характеристик и срока релиза.

Что выбрать разработчику

Для сложных агентных циклов, работы с кодом и мультимодальными документами логичный кандидат: Gemini 3.6 Flash. Для массовой классификации, извлечения данных и дешёвых подагентов подойдёт 3.5 Flash-Lite. Flash Cyber пока нельзя рассматривать как компонент обычного продукта.

Перед миграцией возьмите 50–100 типовых заданий, зафиксируйте успешность и полную стоимость прохода, затем сравните старую и новую модели на одинаковых ограничениях. Отдельно удалите устаревшие параметры генерации и проверьте Computer Use на нужном endpoint. Экономия начинается не с новой цифры в прайс-листе, а с меньшего числа неудачных циклов.

Источники

Читайте также

Telegram-канал @toolarium