Gemini Omni
Назад к статьям
8 мин. чтения

Google представил Gemini 3.6 Flash, 3.5 Flash-Lite и 3.5 Flash Cyber: всё, что нужно знать

Google выпустил Gemini 3.6 Flash, 3.5 Flash-Lite и 3.5 Flash Cyber. Цены, бенчмарки, доступность, безопасность и планы на Gemini 4 — полный разбор анонса.

Gemini 3.6 FlashGemini 3.5 Flash-LiteGemini 3.5 Flash CyberModelsAnnouncement2026Русский

Три новые Flash-модели за один день

21 июля 2026 года Google анонсировал сразу три новые модели Gemini: Gemini 3.6 Flash, Gemini 3.5 Flash-Lite и Gemini 3.5 Flash Cyber. Общая линия очевидна — каждая из них решает одну и ту же проблему, о которой постоянно говорят разработчики: продакшн-агентам на ИИ нужны более высокая токен-эффективность, меньшая задержка и более предсказуемая производительность, а не просто громкие цифры в заголовках.

В этой статье разбираем, для чего нужна каждая модель, сколько она стоит, где её можно использовать уже сегодня и что Google приоткрыл о планах (спойлер: Gemini 3.5 Pro тестируется с партнёрами, а предобучение Gemini 4 уже запущено). Все цифры — из официального анонса.

Линейка одним взглядом

МодельРольКлючевая цифраДоступ
Gemini 3.6 FlashРабочая лошадка: кодинг, работа со знаниями, мультимодальностьНа 17% меньше выходных токенов, чем у 3.5 Flash, при более низкой ценеОбщедоступна с сегодняшнего дня
Gemini 3.5 Flash-LiteСамая быстрая и экономичная модель класса 3.5350 выходных токенов/с (Artificial Analysis)Общедоступна с сегодняшнего дня
Gemini 3.5 Flash CyberСпециалист по безопасности: поиск и исправление уязвимостейНа уровне фронтир-моделей на CyberGym внутри CodeMenderТолько пилот с ограниченным доступом

Gemini 3.6 Flash: новая рабочая лошадка

3.6 Flash напрямую вырос из отзывов разработчиков о 3.5 Flash. Посыл необычен для запуска модели: она не просто лучше, она экономнее. По индексу Artificial Analysis она потребляет на 17% меньше выходных токенов, чем 3.5 Flash, а на некоторых бенчмарках — например, DeepSWE от Datacurve — Google наблюдал сокращения до 65%. Ей также нужно меньше шагов рассуждения и вызовов инструментов для завершения многошаговых рабочих процессов, что складывается в реальную экономию на агентных задачах.

Прирост Gemini 3.6 Flash относительно 3.5 Flash на бенчмарках DeepSWE, MLE Bench, OSWorld-Verified и GDPval-AA v2

Главные бенчмарки в сравнении с 3.5 Flash:

БенчмаркGemini 3.6 FlashGemini 3.5 Flash
DeepSWE (агентный кодинг)49%37%
MLE Bench (ML-исследования)63.9%49.7%
OSWorld-Verified (работа с компьютером)83.0%78.4%
GDPval-AA v2 (работа со знаниями)14211349

Ещё две детали дня запуска важны для тех, кто строит продукты:

  • Управление компьютером теперь встроенный клиентский инструмент в Gemini API и Gemini Enterprise — отдельная обвязка больше не нужна.
  • Среди первых клиентов — Figma, Harvey, Hebbia и JetBrains; Hebbia и Harvey особо отмечают мультимодальные сильные стороны: разбор документов, анализ графиков и данных, подготовку отчётов.

Стоит посмотреть демо Google со сравнением токен-эффективности на задаче OSWorld: демо токен-эффективности 3.6 Flash vs 3.5 Flash (видео).

Полное сравнение — в нашем подробном разборе Gemini 3.6 Flash vs 3.5 Flash.

Gemini 3.5 Flash-Lite: создана для масштабирования агентных процессов

Flash-Lite — это ставка на объём. Это самая быстрая модель серии 3.5350 выходных токенов в секунду (Artificial Analysis) — нацеленная на агентный поиск, обработку документов и любые конвейеры, где узкое место — пропускная способность.

Скачок качества относительно 3.1 Flash-Lite впечатляет — Terminal-Bench 2.1: 54% против 31%, GDM-MRCR v2 (длинный контекст): 72.2% против 60.1%, GDPval-AA v2: 1140 против 642. Что примечательно, она обходит даже более крупный Gemini 3 Flash на нескольких агентных оценках, включая SWE-Bench Pro (54.2% против 49.6%) и OSWorld-Verified (74.0% против 65.1%).

Модель поставляется с настраиваемыми уровнями рассуждения — minimal/low для высоконагруженных задач, где критична задержка, или более высокие уровни для многошаговых субагентных нагрузок — и управление компьютером здесь тоже встроено. Среди первых клиентов — Ashler, Palo Alto Networks и Ramp, а модель разворачивается внутри Google Search и приложения Gemini.

Наш гид по агентным процессам с 3.5 Flash-Lite подробно разбирает уровни рассуждения, расчёт затрат и выбор модели.

Цены: дешевле на обоих уровнях

МодельВход ($/1M токенов)Выход ($/1M токенов)Примечания
Gemini 3.6 Flash$1.50$7.50Ниже, чем у 3.5 Flash, плюс ~17% меньше выходных токенов
Gemini 3.5 Flash-Lite$0.30$2.50Лучшее соотношение цены и производительности для высоконагруженного трафика
Gemini 3.5 Flash CyberПубличной цены нет; пилот с ограниченным доступом через CodeMender

Настоящая история про затраты — это умножение: 3.6 Flash берёт меньше за токен и выдаёт меньше токенов на задачу, поэтому фактическая стоимость агентной задачи падает сильнее, чем следует из прайс-листа.

Gemini 3.5 Flash Cyber: специалист за бархатным канатом

Третья модель — особый случай. 3.5 Flash Cyber построена на 3.5 Flash и дообучена находить и исправлять уязвимости безопасности при более низкой цене за токен, чем у крупных моделей. Она работает внутри CodeMender, агента Google по безопасности кода, где несколько агентов 3.5 Flash Cyber работают вместе и формируют единый сводный отчёт, — достигая конкурентной с фронтир-моделями производительности на бенчмарке CyberGym.

Результаты Gemini 3.5 Flash Cyber на бенчмарке CyberGym внутри CodeMender

Поскольку технология двойного назначения, Google сознательно не выпускает её широко: она будет доступна исключительно правительствам и доверенным партнёрам через CodeMender в рамках пилота с ограниченным доступом. Цель — дать защитникам на передовой фору в исправлении критических уязвимостей до того, как их начнут эксплуатировать.

Безопасность: меньше джейлбрейков, меньше отказов

3.6 Flash выходит с усиленными мерами Frontier Safety, покрывающими злоупотребления в областях ХБРЯ (химической, биологической, радиологической, ядерной) и кибернаступательных операций. По словам Google, модель существенно устойчивее к джейлбрейкам и одновременно обучена сводить к минимуму отказы на легитимных запросах — именно та комбинация, которую разработчики действительно хотят, вместо тупой позиции «отказывать во всём подряд».

Где их можно использовать уже сегодня

ПлощадкаGemini 3.6 FlashGemini 3.5 Flash-Lite
Gemini API (Google AI Studio, Android Studio)
Google Antigravity
Gemini Enterprise Agent Platform
Приложение Gemini Enterprise
Приложение Gemini
Google Search✅ Разворачивается
CodeMender (3.5 Flash Cyber)Ограниченный пилот: только правительства и доверенные партнёры

Намёк на roadmap: 3.5 Pro и Gemini 4

Две заметки о будущем, спрятанные в анонсе, заслуживают внимания:

  1. Gemini 3.5 Pro сейчас тестируется с партнёрами, широкая доступность запланирована «как только модель будет готова».
  2. Google запустил свой самый амбициозный прогон предобучения — для Gemini 4 — и говорит, что «воодушевлён прогрессом».

Если читать вместе, релизы Flash-уровня выглядят как закрепление слоя эффективности перед следующим рывком на фронтир.

Итог

Если вы строите агентов, это редкий запуск, где правильный ход очевиден: 3.6 Flash — для агентной работы, чувствительной к качеству, 3.5 Flash-Lite — для высоконагруженной пропускной способности, и обе дешевле того, что заменяют. Flash Cyber тем временем показывает, куда, по мнению Google, движутся специализированные дообучения: мощные, узкие и намеренно закрытые.

Связанные материалы