Google представил Gemini 3.6 Flash, 3.5 Flash-Lite и 3.5 Flash Cyber: всё, что нужно знать
Google выпустил Gemini 3.6 Flash, 3.5 Flash-Lite и 3.5 Flash Cyber. Цены, бенчмарки, доступность, безопасность и планы на Gemini 4 — полный разбор анонса.
Три новые Flash-модели за один день
21 июля 2026 года Google анонсировал сразу три новые модели Gemini: Gemini 3.6 Flash, Gemini 3.5 Flash-Lite и Gemini 3.5 Flash Cyber. Общая линия очевидна — каждая из них решает одну и ту же проблему, о которой постоянно говорят разработчики: продакшн-агентам на ИИ нужны более высокая токен-эффективность, меньшая задержка и более предсказуемая производительность, а не просто громкие цифры в заголовках.
В этой статье разбираем, для чего нужна каждая модель, сколько она стоит, где её можно использовать уже сегодня и что Google приоткрыл о планах (спойлер: Gemini 3.5 Pro тестируется с партнёрами, а предобучение Gemini 4 уже запущено). Все цифры — из официального анонса.
Линейка одним взглядом
| Модель | Роль | Ключевая цифра | Доступ |
|---|---|---|---|
| Gemini 3.6 Flash | Рабочая лошадка: кодинг, работа со знаниями, мультимодальность | На 17% меньше выходных токенов, чем у 3.5 Flash, при более низкой цене | Общедоступна с сегодняшнего дня |
| Gemini 3.5 Flash-Lite | Самая быстрая и экономичная модель класса 3.5 | 350 выходных токенов/с (Artificial Analysis) | Общедоступна с сегодняшнего дня |
| Gemini 3.5 Flash Cyber | Специалист по безопасности: поиск и исправление уязвимостей | На уровне фронтир-моделей на CyberGym внутри CodeMender | Только пилот с ограниченным доступом |
Gemini 3.6 Flash: новая рабочая лошадка
3.6 Flash напрямую вырос из отзывов разработчиков о 3.5 Flash. Посыл необычен для запуска модели: она не просто лучше, она экономнее. По индексу Artificial Analysis она потребляет на 17% меньше выходных токенов, чем 3.5 Flash, а на некоторых бенчмарках — например, DeepSWE от Datacurve — Google наблюдал сокращения до 65%. Ей также нужно меньше шагов рассуждения и вызовов инструментов для завершения многошаговых рабочих процессов, что складывается в реальную экономию на агентных задачах.

Главные бенчмарки в сравнении с 3.5 Flash:
| Бенчмарк | Gemini 3.6 Flash | Gemini 3.5 Flash |
|---|---|---|
| DeepSWE (агентный кодинг) | 49% | 37% |
| MLE Bench (ML-исследования) | 63.9% | 49.7% |
| OSWorld-Verified (работа с компьютером) | 83.0% | 78.4% |
| GDPval-AA v2 (работа со знаниями) | 1421 | 1349 |
Ещё две детали дня запуска важны для тех, кто строит продукты:
- Управление компьютером теперь встроенный клиентский инструмент в Gemini API и Gemini Enterprise — отдельная обвязка больше не нужна.
- Среди первых клиентов — Figma, Harvey, Hebbia и JetBrains; Hebbia и Harvey особо отмечают мультимодальные сильные стороны: разбор документов, анализ графиков и данных, подготовку отчётов.
Стоит посмотреть демо Google со сравнением токен-эффективности на задаче OSWorld: демо токен-эффективности 3.6 Flash vs 3.5 Flash (видео).
Полное сравнение — в нашем подробном разборе Gemini 3.6 Flash vs 3.5 Flash.
Gemini 3.5 Flash-Lite: создана для масштабирования агентных процессов
Flash-Lite — это ставка на объём. Это самая быстрая модель серии 3.5 — 350 выходных токенов в секунду (Artificial Analysis) — нацеленная на агентный поиск, обработку документов и любые конвейеры, где узкое место — пропускная способность.
Скачок качества относительно 3.1 Flash-Lite впечатляет — Terminal-Bench 2.1: 54% против 31%, GDM-MRCR v2 (длинный контекст): 72.2% против 60.1%, GDPval-AA v2: 1140 против 642. Что примечательно, она обходит даже более крупный Gemini 3 Flash на нескольких агентных оценках, включая SWE-Bench Pro (54.2% против 49.6%) и OSWorld-Verified (74.0% против 65.1%).
Модель поставляется с настраиваемыми уровнями рассуждения — minimal/low для высоконагруженных задач, где критична задержка, или более высокие уровни для многошаговых субагентных нагрузок — и управление компьютером здесь тоже встроено. Среди первых клиентов — Ashler, Palo Alto Networks и Ramp, а модель разворачивается внутри Google Search и приложения Gemini.
Наш гид по агентным процессам с 3.5 Flash-Lite подробно разбирает уровни рассуждения, расчёт затрат и выбор модели.
Цены: дешевле на обоих уровнях
| Модель | Вход ($/1M токенов) | Выход ($/1M токенов) | Примечания |
|---|---|---|---|
| Gemini 3.6 Flash | $1.50 | $7.50 | Ниже, чем у 3.5 Flash, плюс ~17% меньше выходных токенов |
| Gemini 3.5 Flash-Lite | $0.30 | $2.50 | Лучшее соотношение цены и производительности для высоконагруженного трафика |
| Gemini 3.5 Flash Cyber | — | — | Публичной цены нет; пилот с ограниченным доступом через CodeMender |
Настоящая история про затраты — это умножение: 3.6 Flash берёт меньше за токен и выдаёт меньше токенов на задачу, поэтому фактическая стоимость агентной задачи падает сильнее, чем следует из прайс-листа.
Gemini 3.5 Flash Cyber: специалист за бархатным канатом
Третья модель — особый случай. 3.5 Flash Cyber построена на 3.5 Flash и дообучена находить и исправлять уязвимости безопасности при более низкой цене за токен, чем у крупных моделей. Она работает внутри CodeMender, агента Google по безопасности кода, где несколько агентов 3.5 Flash Cyber работают вместе и формируют единый сводный отчёт, — достигая конкурентной с фронтир-моделями производительности на бенчмарке CyberGym.

Поскольку технология двойного назначения, Google сознательно не выпускает её широко: она будет доступна исключительно правительствам и доверенным партнёрам через CodeMender в рамках пилота с ограниченным доступом. Цель — дать защитникам на передовой фору в исправлении критических уязвимостей до того, как их начнут эксплуатировать.
Безопасность: меньше джейлбрейков, меньше отказов
3.6 Flash выходит с усиленными мерами Frontier Safety, покрывающими злоупотребления в областях ХБРЯ (химической, биологической, радиологической, ядерной) и кибернаступательных операций. По словам Google, модель существенно устойчивее к джейлбрейкам и одновременно обучена сводить к минимуму отказы на легитимных запросах — именно та комбинация, которую разработчики действительно хотят, вместо тупой позиции «отказывать во всём подряд».
Где их можно использовать уже сегодня
| Площадка | Gemini 3.6 Flash | Gemini 3.5 Flash-Lite |
|---|---|---|
| Gemini API (Google AI Studio, Android Studio) | ✅ | ✅ |
| Google Antigravity | ✅ | — |
| Gemini Enterprise Agent Platform | ✅ | ✅ |
| Приложение Gemini Enterprise | ✅ | — |
| Приложение Gemini | ✅ | ✅ |
| Google Search | — | ✅ Разворачивается |
| CodeMender (3.5 Flash Cyber) | Ограниченный пилот: только правительства и доверенные партнёры |
Намёк на roadmap: 3.5 Pro и Gemini 4
Две заметки о будущем, спрятанные в анонсе, заслуживают внимания:
- Gemini 3.5 Pro сейчас тестируется с партнёрами, широкая доступность запланирована «как только модель будет готова».
- Google запустил свой самый амбициозный прогон предобучения — для Gemini 4 — и говорит, что «воодушевлён прогрессом».
Если читать вместе, релизы Flash-уровня выглядят как закрепление слоя эффективности перед следующим рывком на фронтир.
Итог
Если вы строите агентов, это редкий запуск, где правильный ход очевиден: 3.6 Flash — для агентной работы, чувствительной к качеству, 3.5 Flash-Lite — для высоконагруженной пропускной способности, и обе дешевле того, что заменяют. Flash Cyber тем временем показывает, куда, по мнению Google, движутся специализированные дообучения: мощные, узкие и намеренно закрытые.