Google ogłasza Gemini 3.6 Flash, 3.5 Flash-Lite i 3.5 Flash Cyber: wszystko, co musisz wiedzieć
Google wypuszcza Gemini 3.6 Flash, 3.5 Flash-Lite i 3.5 Flash Cyber. Ceny, benchmarki, dostępność, bezpieczeństwo i plany na Gemini 4 — pełne omówienie premiery.
Trzy nowe modele Flash jednego dnia
21 lipca 2026 Google ogłosiło trzy nowe modele Gemini za jednym zamachem: Gemini 3.6 Flash, Gemini 3.5 Flash-Lite i Gemini 3.5 Flash Cyber. Wspólny mianownik jest oczywisty — każdy z nich mierzy się z tym samym problemem, który deweloperzy zgłaszają bez przerwy: agenty AI w produkcji potrzebują większej efektywności tokenowej, niższych opóźnień i bardziej przewidywalnej wydajności, a nie tylko wyższych wyników na papierze.
W tym artykule rozkładamy na czynniki pierwsze, do czego służy każdy model, ile kosztuje, gdzie można go używać już dziś i co Google zdradziło o dalszych planach (spoiler: Gemini 3.5 Pro jest w testach u partnerów, a pre-training Gemini 4 już wystartował). Wszystkie liczby pochodzą z oficjalnego ogłoszenia.
Cała oferta w skrócie
| Model | Rola | Kluczowa liczba | Dostęp |
|---|---|---|---|
| Gemini 3.6 Flash | Koń roboczy: kodowanie, praca z wiedzą, multimodalność | 17% mniej tokenów wyjściowych niż 3.5 Flash, przy niższej cenie | Ogólnie dostępny od dziś |
| Gemini 3.5 Flash-Lite | Najszybszy i najtańszy model klasy 3.5 | 350 tokenów wyjściowych/s (Artificial Analysis) | Ogólnie dostępny od dziś |
| Gemini 3.5 Flash Cyber | Specjalista od bezpieczeństwa: wyszukiwanie i naprawa podatności | Wyniki na poziomie modeli frontier na CyberGym w ramach CodeMender | Tylko pilotaż z ograniczonym dostępem |
Gemini 3.6 Flash: nowy koń roboczy
3.6 Flash powstał bezpośrednio na bazie opinii deweloperów o 3.5 Flash. Przekaz jest nietypowy jak na premierę modelu: nie jest tylko lepszy, jest oszczędniejszy. Na indeksie Artificial Analysis zużywa 17% mniej tokenów wyjściowych niż 3.5 Flash, a na niektórych benchmarkach — jak DeepSWE od Datacurve — Google zaobserwowało redukcje nawet o 65%. Potrzebuje też mniej kroków rozumowania i wywołań narzędzi, by ukończyć wieloetapowe przepływy pracy, co przekłada się na realne oszczędności w zadaniach agentowych.

Najważniejsze benchmarki względem 3.5 Flash:
| Benchmark | Gemini 3.6 Flash | Gemini 3.5 Flash |
|---|---|---|
| DeepSWE (kodowanie agentowe) | 49% | 37% |
| MLE Bench (badania ML) | 63.9% | 49.7% |
| OSWorld-Verified (obsługa komputera) | 83.0% | 78.4% |
| GDPval-AA v2 (praca z wiedzą) | 1421 | 1349 |
Dwa dodatkowe szczegóły z dnia premiery ważne dla budujących:
- Obsługa komputera jest teraz wbudowanym narzędziem po stronie klienta w Gemini API i Gemini Enterprise — bez osobnego rusztowania.
- Wśród pierwszych klientów są Figma, Harvey, Hebbia i JetBrains; Hebbia i Harvey podkreślają zwłaszcza mocne strony multimodalne: parsowanie dokumentów, analizę wykresów i danych oraz przygotowywanie raportów.
Warto obejrzeć demo Google porównujące efektywność tokenową na zadaniu OSWorld: demo efektywności tokenowej 3.6 Flash vs 3.5 Flash (wideo).
Pełne porównanie znajdziesz w naszej szczegółowej analizie Gemini 3.6 Flash vs 3.5 Flash.
Gemini 3.5 Flash-Lite: zbudowany do skalowania agentowych przepływów pracy
Flash-Lite to karta na wolumen. To najszybszy model serii 3.5 — 350 tokenów wyjściowych na sekundę (Artificial Analysis) — wycelowany w wyszukiwanie agentowe, przetwarzanie dokumentów i każdy potok, w którym wąskim gardłem jest przepustowość.
Skok jakości względem 3.1 Flash-Lite jest dramatyczny — Terminal-Bench 2.1 na poziomie 54% wobec 31%, GDM-MRCR v2 (długi kontekst) 72.2% wobec 60.1% oraz GDPval-AA v2 1140 wobec 642. Co ciekawe, pokonuje nawet większy Gemini 3 Flash w kilku ewaluacjach agentowych, w tym SWE-Bench Pro (54.2% wobec 49.6%) i OSWorld-Verified (74.0% wobec 65.1%).
Model ma konfigurowalne poziomy myślenia — minimal/low dla wysokowolumenowych zadań, gdzie liczy się opóźnienie, albo wyższe poziomy dla wieloetapowych obciążeń z subagentami — a obsługa komputera również jest tu wbudowana. Wśród pierwszych klientów są Ashler, Palo Alto Networks i Ramp, a model wdrażany jest w Google Search i aplikacji Gemini.
Nasz przewodnik po agentowych przepływach pracy z 3.5 Flash-Lite szczegółowo omawia poziomy myślenia, rachunek kosztów i dobór modelu.
Ceny: taniej na obu poziomach
| Model | Wejście ($/1M tokenów) | Wyjście ($/1M tokenów) | Uwagi |
|---|---|---|---|
| Gemini 3.6 Flash | $1.50 | $7.50 | Taniej niż 3.5 Flash, plus ~17% mniej tokenów wyjściowych |
| Gemini 3.5 Flash-Lite | $0.30 | $2.50 | Najlepszy stosunek ceny do wydajności dla ruchu o wysokiej przepustowości |
| Gemini 3.5 Flash Cyber | — | — | Brak publicznej ceny; pilotaż z ograniczonym dostępem przez CodeMender |
Prawdziwa historia kosztów to mnożenie: 3.6 Flash liczy mniej za token i emituje mniej tokenów na zadanie, więc efektywny koszt zadania agentowego spada mocniej, niż sugeruje cennik.
Gemini 3.5 Flash Cyber: specjalista za aksamitnym sznurem
Trzeci model jest inny. 3.5 Flash Cyber bazuje na 3.5 Flash i jest dostrojony do wyszukiwania i naprawiania podatności bezpieczeństwa przy niższej cenie za token niż większe modele. Działa wewnątrz CodeMender, agenta bezpieczeństwa kodu od Google, gdzie wiele agentów 3.5 Flash Cyber współpracuje, by wytworzyć jeden zbiorczy raport — osiągając wyniki konkurencyjne wobec modeli frontier na benchmarku CyberGym.

Ponieważ technologia ma podwójne zastosowanie, Google celowo nie udostępnia jej szeroko: będzie dostępna wyłącznie dla rządów i zaufanych partnerów przez CodeMender w ramach pilotażu z ograniczonym dostępem. Celem jest danie obrońcom pierwszej linii przewagi w łataniu krytycznych podatności, zanim zostaną wykorzystane.
Bezpieczeństwo: mniej jailbreaków, mniej odmów
3.6 Flash dostaje wzmocnione zabezpieczenia Frontier Safety obejmujące nadużycia w obszarach CBRN (chemicznym, biologicznym, radiologicznym, nuklearnym) i cyberofensywnym. Google twierdzi, że model jest znacząco odporniejszy na jailbreaki, a jednocześnie wytrenowany, by minimalizować odmowy przy legalnych zastosowaniach — dokładnie ta kombinacja, której deweloperzy naprawdę chcą, zamiast postawy odmawiania wszystkiego jak leci.
Gdzie można ich używać już dziś
| Powierzchnia | Gemini 3.6 Flash | Gemini 3.5 Flash-Lite |
|---|---|---|
| Gemini API (Google AI Studio, Android Studio) | ✅ | ✅ |
| Google Antigravity | ✅ | — |
| Gemini Enterprise Agent Platform | ✅ | ✅ |
| Aplikacja Gemini Enterprise | ✅ | — |
| Aplikacja Gemini | ✅ | ✅ |
| Google Search | — | ✅ W trakcie wdrażania |
| CodeMender (3.5 Flash Cyber) | Ograniczony pilotaż: tylko rządy i zaufani partnerzy |
Zapowiedź roadmapy: 3.5 Pro i Gemini 4
Dwie wybiegające w przyszłość wzmianki, ukryte w ogłoszeniu, zasługują na uwagę:
- Gemini 3.5 Pro jest obecnie testowany z partnerami, z szeroką dostępnością planowaną „gdy tylko będzie gotowy”.
- Google rozpoczęło swój najambitniejszy pre-training w historii — dla Gemini 4 — i deklaruje, że jest „podekscytowane postępami”.
Czytane razem, premiery poziomu Flash wyglądają jak domykanie warstwy efektywności przed kolejnym skokiem na granicę możliwości.
Podsumowanie
Jeśli budujesz agenty, to rzadka premiera, w której właściwy ruch jest oczywisty: 3.6 Flash do pracy agentowej wrażliwej na jakość, 3.5 Flash-Lite do wysokowolumenowej przepustowości — oba tańsze od tego, co zastępują. Flash Cyber sygnalizuje z kolei, dokąd zdaniem Google zmierzają wyspecjalizowane fine-tuny: potężne, wąskie i celowo reglamentowane.