Gemini 3.6 Flash и две новые модели Google: цена и доступность
Google выпустила Gemini 3.6 Flash и 3.5 Flash-Lite, а также показала закрытую Flash Cyber. Сравниваем цены, доступность и ограничения.
По состоянию на 21 июля 2026 года Gemini 3.6 Flash стала новой производственной моделью Google для кода, агентных циклов и мультимодальных задач. Компания сохранила цену входа на уровне Gemini 3.5 Flash, снизила цену выхода и одновременно выпустила более дешёвую Gemini 3.5 Flash-Lite. Третья новинка, Gemini 3.5 Flash Cyber, предназначена для поиска уязвимостей и пока не выходит в публичный Gemini API.
Для разработчиков в анонсе важнее не новый номер версии, а экономика полного задания. Google обещает меньше лишних рассуждений, повторных вызовов инструментов и выходных токенов. Ниже разбираем подтверждённые цены, доступность и ограничения, а заявления о производительности отделяем от независимо проверяемых данных.
Что Google выпустила 21 июля
Две массовые модели получили стабильные идентификаторы gemini-3.6-flash и gemini-3.5-flash-lite. Обе имеют статус GA и готовы для производственных систем. Flash Cyber устроена иначе: это специальная версия поверх 3.5 Flash, которую Google DeepMind планирует выдавать правительствам и доверенным партнёрам через CodeMender.
| Модель | Статус и доступ | Standard API, $ за 1 млн токенов | Основная задача | Ключевое ограничение | Источник |
|---|---|---|---|---|---|
gemini-3.6-flash | GA; Gemini API, AI Studio, Android Studio, Gemini app и корпоративные продукты | 1,50 вход / 7,50 выход | Сложные агентные циклы, код и мультимодальный анализ | Заявления о росте качества основаны на тестах Google и отдельных внешних оценках | карточка модели |
gemini-3.5-flash-lite | GA; Gemini API, AI Studio, Android Studio и Gemini app, развёртывание в Search | 0,30 вход / 2,50 выход | Высокопоточная обработка, извлечение данных и подагенты | Официальные страницы расходятся в статусе Computer Use | руководство по новым моделям |
| Gemini 3.5 Flash Cyber | Ограниченный пилот через CodeMender для правительств и доверенных партнёров | Не опубликована | Поиск, проверка и исправление уязвимостей | Нет общедоступного endpoint в Gemini API | анонс DeepMind |
gemini-3.5-flash | Стабильная модель; Google предлагает миграцию на 3.6 Flash | 1,50 вход / 9,00 выход | База для сравнения с новым релизом | Выходные токены стоят дороже, чем у 3.6 Flash | страница цен |
Цены в таблице актуальны на 21 июля 2026 года и относятся к стандартному платному API. Бесплатный уровень, пакетная обработка, Flex и Priority тарифицируются отдельно. Для агентной системы сравнивать надо итоговую стоимость задания, а не только цену миллиона токенов.
Чем Gemini 3.6 Flash отличается от Gemini 3.5 Flash
Главное подтверждённое изменение: цена выхода $7,50 вместо $9 за 1 млн токенов, то есть на 16,7% ниже. Вход остаётся на уровне $1,50. Обе модели используют контекст до 1 048 576 токенов и могут вернуть до 65 536 токенов за ответ.
Google также пишет, что новая модель делает меньше промежуточных шагов, реже зацикливается и вызывает меньше инструментов в многошаговых заданиях. В Artificial Analysis Index она использовала на 17% меньше выходных токенов, а в отдельных тестах DeepSWE экономия доходила до 65%. Эти проценты нельзя переносить на любой продукт: один относится к конкретному индексу, второй — к отдельному тесту программных агентов.

Экономию лучше проверять на своём наборе заданий через обе версии. Считайте четыре показателя: успешность, задержку, число вызовов инструментов и суммарные входные с выходными токенами. Более дешёвый выход не спасёт сценарий, если агент чаще повторяет шаги или требует ручной доработки.
Gemini 3.5 Flash-Lite для потока простых задач
Flash-Lite стоит в пять раз дешевле 3.6 Flash по входу и в три раза по выходу. Google называет её моделью для извлечения данных из документов, разбора таблиц, маршрутизации, классификации и работы подагентов. В анонсе компания ссылается на измерение Artificial Analysis в 350 выходных токенов в секунду.
Такая модель подходит не для роли единственного «мозга» системы, а для большого числа коротких операций. Старшая 3.6 Flash может строить план, а Flash-Lite параллельно разбирать чеки, документы или результаты поиска. Этот подход совпадает с тем, как Google развивает Managed Agents в Gemini API: стоимость подагентов становится частью архитектуры, а не примечанием в тарифах.

Где доступны новые модели
Gemini 3.6 Flash и 3.5 Flash-Lite доступны разработчикам через Gemini API, Google AI Studio и Android Studio. Первая модель также пришла в Antigravity. Для компаний Google добавила обе версии в Gemini Enterprise Agent Platform; 3.6 Flash доступна и в Gemini Enterprise app.
Пользовательские версии появились в приложении Gemini; Flash-Lite дополнительно разворачивается в Google Search. Суть различия проста: название в приложении не гарантирует тот же набор инструментов, лимитов и настроек, что у стабильного API-идентификатора.
Предыдущая Gemini 3.5 Flash, представленная на Google I/O 2026, остаётся в документации как стабильная модель. Однако руководство Google уже указывает 3.6 Flash как путь миграции для 3.5 Flash, Gemini 3 Flash Preview и Gemini 3.1 Pro.
В API появились несовместимые изменения
Вместе с релизом Google объявила устаревшими параметры temperature, top_p и top_k для новых моделей. Сейчас API их игнорирует, а в будущих версиях обещает отвечать ошибкой 400. Предзаполненный ход модели в конце диалога тоже больше не поддерживается. Командам, которые подталкивали ответ префиксом вроде Translation:, придётся перенести требование в системную инструкцию или structured outputs.
Есть и менее приятная проблема. Руководство по миграции пишет, что обе массовые модели поддерживают полный набор встроенных инструментов, включая Computer Use. А отдельная карточка Gemini 3.5 Flash-Lite, обновлённая в тот же день, показывает Computer use: Not supported. В анонсе Google функция снова названа встроенной. Пока документация не согласована, проверяйте конкретный API и поверхность доступа перед тем, как закладывать управление интерфейсом в архитектуру. Для контекста у нас есть отдельный разбор Computer Use в Gemini 3.5 Flash.
Gemini 3.5 Flash Cyber остаётся закрытой
Flash Cyber построена поверх 3.5 Flash и дообучена искать, подтверждать и исправлять уязвимости. CodeMender вызывает несколько таких моделей как подагентов, а затем собирает единый отчёт. DeepMind утверждает, что в тесте на движке V8 новая версия нашла 55 подтверждённых уникальных проблем против 47 у обычной 3.5 Flash и 36 у Claude Opus 4.6.
Сравнение требует осторожности: методику и запуск контролировала Google, а в других тестах поставщики сообщали результаты самостоятельно. Доступ тоже намеренно ограничен. Пилот должен начаться через CodeMender для правительств и доверенных партнёров; публичной цены и обычного API-вызова нет.
Gemini 3.5 Pro всё ещё тестируется
Google не выпустила Gemini 3.5 Pro вместе с тремя Flash-моделями. В официальном анонсе сказано только, что версия тестируется с партнёрами и станет широко доступна, когда будет готова. Новой даты компания не назвала. Одновременно Google подтвердила начало предварительного обучения Gemini 4, но без характеристик и срока релиза.
Что выбрать разработчику
Для сложных агентных циклов, работы с кодом и мультимодальными документами логичный кандидат: Gemini 3.6 Flash. Для массовой классификации, извлечения данных и дешёвых подагентов подойдёт 3.5 Flash-Lite. Flash Cyber пока нельзя рассматривать как компонент обычного продукта.
Перед миграцией возьмите 50–100 типовых заданий, зафиксируйте успешность и полную стоимость прохода, затем сравните старую и новую модели на одинаковых ограничениях. Отдельно удалите устаревшие параметры генерации и проверьте Computer Use на нужном endpoint. Экономия начинается не с новой цифры в прайс-листе, а с меньшего числа неудачных циклов.
Источники
- официальный анонс Google трёх моделей
- руководство Gemini API по новым моделям и миграции
- актуальные цены Gemini Developer API
- карточка модели 3.6 Flash
- карточка Gemini 3.5 Flash-Lite
- анонс Gemini 3.5 Flash Cyber от Google DeepMind