Три Flash-модели вместо одного универсального релиза

Gemini 3.6 Flash стала центральной моделью релиза. Google позиционирует ее как быстрый вариант для задач, где мало короткого ответа: программирование, длинные документы, агентные циклы и работа с интерфейсами. По официальной карточке модели она поддерживает контекст до одного миллиона токенов и ответ до 65 536 токенов. Это оставляет запас не только для чата, но и для больших репозиториев, журналов, пакетов документов и многошаговой автоматизации.

Рядом вышла Gemini 3.5 Flash-Lite. Ее роль проще: массовые запросы, классификация, извлечение данных и другие сценарии, где важнее цена и пропускная способность, чем максимальное качество рассуждения. Тариф установлен на уровне 0,30 доллара за миллион входных токенов и 2,50 доллара за миллион выходных. Для 3.6 Flash цены выше: 1,50 и 7,50 доллара соответственно.

Третья модель, Gemini 3.5 Flash Cyber, не является обычным публичным API-продуктом. Google ограничивает ее доступ государственными организациями и доверенными партнерами, а первым каналом называет закрытый пилот CodeMender. Для большинства разработчиков это важная граница: упоминание Cyber в релизе не означает, что модель можно выбрать в AI Studio и подключить к своему сервису.

Computer Use переводит Flash из чата в рабочий интерфейс

Самое заметное продуктовое изменение в 3.6 Flash - встроенный инструмент Computer Use. Модель может участвовать в сценариях, где агент анализирует экран, выбирает действие и двигается по интерфейсу. Google приводит результат 83,0% на OSWorld-Verified против 78,4% у предыдущей Flash. Это показатель лабораторного теста, а не гарантия надежной работы на любом сайте или в корпоративном приложении, но направление очевидно: быстрая модель теперь рассчитана на действие, а не только на генерацию текста.

В кодинге Google заявляет 49% на DeepSWE против 37% у Gemini 3.5 Flash и одновременно сообщает о меньшем расходе выходных токенов в собственных сравнениях. Для разработчика это потенциально означает более короткие агентные циклы и меньшую стоимость длинных задач. Однако все цифры опубликованы самим поставщиком. Перед миграцией стоит повторить свои eval-наборы: ошибки в приватном API, нестандартной сборке или старом фронтенде не обязаны коррелировать с публичным бенчмарком.

Gemini 3.6 Flash выбрана в меню моделей GitHub Copilot
Источник: GitHub. Gemini 3.6 Flash постепенно появляется в выборе моделей Copilot.

Релиз уже идет в API, Copilot и пользовательские продукты

Gemini 3.6 Flash доступна через Gemini API и Google AI Studio, а также входит в Android Studio, Antigravity, Gemini Enterprise и приложение Gemini. Flash-Lite должна постепенно появиться и в поисковых сценариях Google. Отдельно GitHub объявила развертывание 3.6 Flash в Copilot: модель появится в VS Code, Visual Studio, JetBrains, Xcode, Eclipse, Copilot CLI, облачном coding agent и мобильном приложении.

Доступ не будет одновременным для всех. GitHub говорит о постепенном rollout, а организациям на Business и Enterprise нужно разрешить preview-модели в административной политике. Поэтому отсутствие Gemini 3.6 Flash в меню сегодня не обязательно означает проблему с подпиской. Для пользователей Pro, Pro+ и Max модель тоже включается поэтапно.

Это делает релиз значимым не только для разработчиков API. Многие пользователи впервые столкнутся с моделью через Copilot или встроенные продукты Google, не меняя собственный код. При этом выбор модели остается практическим: Flash-Lite лучше подходит для большого потока простых операций, а 3.6 Flash - для задач, где экономия на каждом токене легко проигрывает стоимости неверного действия агента.

Переход требует проверки параметров, бюджета и права на действие

Главный подвох для разработчиков связан с совместимостью. В документации Google для нового поколения отдельно отмечены изменения в поддержке некоторых параметров сэмплирования и поведения запросов. Если приложение жестко задает temperature, top-p, top-k или использует предварительно заполненный ответ модели, сначала проверьте фактический контракт Gemini 3.6 Flash на тестовом окружении. Простая замена model id может изменить результат или вызвать ошибку.

Командам, которые уже строят coding agents или браузерную автоматизацию, обновление имеет смысл тестировать сразу: миллионный контекст и Computer Use попадают точно в их узкое место. Сервисам с миллионами коротких запросов выгоднее сначала сравнить Flash-Lite с текущей моделью на цене, задержке и доле брака. Обычному пользователю можно не искать переключатель вручную: релиз дойдет через продукты постепенно, а реальную разницу лучше оценивать на собственных задачах, а не по названию версии.

И наконец, Computer Use не отменяет контроль. Агенту нельзя автоматически выдавать право отправлять платежи, удалять данные или менять продакшен без подтверждения. Новая Flash выглядит быстрее и сильнее, но цена ошибки действия выше цены неудачного текстового ответа. Для рабочих внедрений обязательны ограниченные разрешения, журнал действий и ручное подтверждение необратимых шагов.