Gemini Omni
Wróć do listy
8 min czytania

Google ogłasza Gemini 3.6 Flash, 3.5 Flash-Lite i 3.5 Flash Cyber: wszystko, co musisz wiedzieć

Google wypuszcza Gemini 3.6 Flash, 3.5 Flash-Lite i 3.5 Flash Cyber. Ceny, benchmarki, dostępność, bezpieczeństwo i plany na Gemini 4 — pełne omówienie premiery.

Gemini 3.6 FlashGemini 3.5 Flash-LiteGemini 3.5 Flash CyberModelsAnnouncement2026Polski

Trzy nowe modele Flash jednego dnia

21 lipca 2026 Google ogłosiło trzy nowe modele Gemini za jednym zamachem: Gemini 3.6 Flash, Gemini 3.5 Flash-Lite i Gemini 3.5 Flash Cyber. Wspólny mianownik jest oczywisty — każdy z nich mierzy się z tym samym problemem, który deweloperzy zgłaszają bez przerwy: agenty AI w produkcji potrzebują większej efektywności tokenowej, niższych opóźnień i bardziej przewidywalnej wydajności, a nie tylko wyższych wyników na papierze.

W tym artykule rozkładamy na czynniki pierwsze, do czego służy każdy model, ile kosztuje, gdzie można go używać już dziś i co Google zdradziło o dalszych planach (spoiler: Gemini 3.5 Pro jest w testach u partnerów, a pre-training Gemini 4 już wystartował). Wszystkie liczby pochodzą z oficjalnego ogłoszenia.

Cała oferta w skrócie

ModelRolaKluczowa liczbaDostęp
Gemini 3.6 FlashKoń roboczy: kodowanie, praca z wiedzą, multimodalność17% mniej tokenów wyjściowych niż 3.5 Flash, przy niższej cenieOgólnie dostępny od dziś
Gemini 3.5 Flash-LiteNajszybszy i najtańszy model klasy 3.5350 tokenów wyjściowych/s (Artificial Analysis)Ogólnie dostępny od dziś
Gemini 3.5 Flash CyberSpecjalista od bezpieczeństwa: wyszukiwanie i naprawa podatnościWyniki na poziomie modeli frontier na CyberGym w ramach CodeMenderTylko pilotaż z ograniczonym dostępem

Gemini 3.6 Flash: nowy koń roboczy

3.6 Flash powstał bezpośrednio na bazie opinii deweloperów o 3.5 Flash. Przekaz jest nietypowy jak na premierę modelu: nie jest tylko lepszy, jest oszczędniejszy. Na indeksie Artificial Analysis zużywa 17% mniej tokenów wyjściowych niż 3.5 Flash, a na niektórych benchmarkach — jak DeepSWE od Datacurve — Google zaobserwowało redukcje nawet o 65%. Potrzebuje też mniej kroków rozumowania i wywołań narzędzi, by ukończyć wieloetapowe przepływy pracy, co przekłada się na realne oszczędności w zadaniach agentowych.

Wzrosty Gemini 3.6 Flash względem 3.5 Flash w benchmarkach DeepSWE, MLE Bench, OSWorld-Verified i GDPval-AA v2

Najważniejsze benchmarki względem 3.5 Flash:

BenchmarkGemini 3.6 FlashGemini 3.5 Flash
DeepSWE (kodowanie agentowe)49%37%
MLE Bench (badania ML)63.9%49.7%
OSWorld-Verified (obsługa komputera)83.0%78.4%
GDPval-AA v2 (praca z wiedzą)14211349

Dwa dodatkowe szczegóły z dnia premiery ważne dla budujących:

  • Obsługa komputera jest teraz wbudowanym narzędziem po stronie klienta w Gemini API i Gemini Enterprise — bez osobnego rusztowania.
  • Wśród pierwszych klientów są Figma, Harvey, Hebbia i JetBrains; Hebbia i Harvey podkreślają zwłaszcza mocne strony multimodalne: parsowanie dokumentów, analizę wykresów i danych oraz przygotowywanie raportów.

Warto obejrzeć demo Google porównujące efektywność tokenową na zadaniu OSWorld: demo efektywności tokenowej 3.6 Flash vs 3.5 Flash (wideo).

Pełne porównanie znajdziesz w naszej szczegółowej analizie Gemini 3.6 Flash vs 3.5 Flash.

Gemini 3.5 Flash-Lite: zbudowany do skalowania agentowych przepływów pracy

Flash-Lite to karta na wolumen. To najszybszy model serii 3.5350 tokenów wyjściowych na sekundę (Artificial Analysis) — wycelowany w wyszukiwanie agentowe, przetwarzanie dokumentów i każdy potok, w którym wąskim gardłem jest przepustowość.

Skok jakości względem 3.1 Flash-Lite jest dramatyczny — Terminal-Bench 2.1 na poziomie 54% wobec 31%, GDM-MRCR v2 (długi kontekst) 72.2% wobec 60.1% oraz GDPval-AA v2 1140 wobec 642. Co ciekawe, pokonuje nawet większy Gemini 3 Flash w kilku ewaluacjach agentowych, w tym SWE-Bench Pro (54.2% wobec 49.6%) i OSWorld-Verified (74.0% wobec 65.1%).

Model ma konfigurowalne poziomy myślenia — minimal/low dla wysokowolumenowych zadań, gdzie liczy się opóźnienie, albo wyższe poziomy dla wieloetapowych obciążeń z subagentami — a obsługa komputera również jest tu wbudowana. Wśród pierwszych klientów są Ashler, Palo Alto Networks i Ramp, a model wdrażany jest w Google Search i aplikacji Gemini.

Nasz przewodnik po agentowych przepływach pracy z 3.5 Flash-Lite szczegółowo omawia poziomy myślenia, rachunek kosztów i dobór modelu.

Ceny: taniej na obu poziomach

ModelWejście ($/1M tokenów)Wyjście ($/1M tokenów)Uwagi
Gemini 3.6 Flash$1.50$7.50Taniej niż 3.5 Flash, plus ~17% mniej tokenów wyjściowych
Gemini 3.5 Flash-Lite$0.30$2.50Najlepszy stosunek ceny do wydajności dla ruchu o wysokiej przepustowości
Gemini 3.5 Flash CyberBrak publicznej ceny; pilotaż z ograniczonym dostępem przez CodeMender

Prawdziwa historia kosztów to mnożenie: 3.6 Flash liczy mniej za token i emituje mniej tokenów na zadanie, więc efektywny koszt zadania agentowego spada mocniej, niż sugeruje cennik.

Gemini 3.5 Flash Cyber: specjalista za aksamitnym sznurem

Trzeci model jest inny. 3.5 Flash Cyber bazuje na 3.5 Flash i jest dostrojony do wyszukiwania i naprawiania podatności bezpieczeństwa przy niższej cenie za token niż większe modele. Działa wewnątrz CodeMender, agenta bezpieczeństwa kodu od Google, gdzie wiele agentów 3.5 Flash Cyber współpracuje, by wytworzyć jeden zbiorczy raport — osiągając wyniki konkurencyjne wobec modeli frontier na benchmarku CyberGym.

Wyniki Gemini 3.5 Flash Cyber w benchmarku CyberGym wewnątrz CodeMender

Ponieważ technologia ma podwójne zastosowanie, Google celowo nie udostępnia jej szeroko: będzie dostępna wyłącznie dla rządów i zaufanych partnerów przez CodeMender w ramach pilotażu z ograniczonym dostępem. Celem jest danie obrońcom pierwszej linii przewagi w łataniu krytycznych podatności, zanim zostaną wykorzystane.

Bezpieczeństwo: mniej jailbreaków, mniej odmów

3.6 Flash dostaje wzmocnione zabezpieczenia Frontier Safety obejmujące nadużycia w obszarach CBRN (chemicznym, biologicznym, radiologicznym, nuklearnym) i cyberofensywnym. Google twierdzi, że model jest znacząco odporniejszy na jailbreaki, a jednocześnie wytrenowany, by minimalizować odmowy przy legalnych zastosowaniach — dokładnie ta kombinacja, której deweloperzy naprawdę chcą, zamiast postawy odmawiania wszystkiego jak leci.

Gdzie można ich używać już dziś

PowierzchniaGemini 3.6 FlashGemini 3.5 Flash-Lite
Gemini API (Google AI Studio, Android Studio)
Google Antigravity
Gemini Enterprise Agent Platform
Aplikacja Gemini Enterprise
Aplikacja Gemini
Google Search✅ W trakcie wdrażania
CodeMender (3.5 Flash Cyber)Ograniczony pilotaż: tylko rządy i zaufani partnerzy

Zapowiedź roadmapy: 3.5 Pro i Gemini 4

Dwie wybiegające w przyszłość wzmianki, ukryte w ogłoszeniu, zasługują na uwagę:

  1. Gemini 3.5 Pro jest obecnie testowany z partnerami, z szeroką dostępnością planowaną „gdy tylko będzie gotowy”.
  2. Google rozpoczęło swój najambitniejszy pre-training w historii — dla Gemini 4 — i deklaruje, że jest „podekscytowane postępami”.

Czytane razem, premiery poziomu Flash wyglądają jak domykanie warstwy efektywności przed kolejnym skokiem na granicę możliwości.

Podsumowanie

Jeśli budujesz agenty, to rzadka premiera, w której właściwy ruch jest oczywisty: 3.6 Flash do pracy agentowej wrażliwej na jakość, 3.5 Flash-Lite do wysokowolumenowej przepustowości — oba tańsze od tego, co zastępują. Flash Cyber sygnalizuje z kolei, dokąd zdaniem Google zmierzają wyspecjalizowane fine-tuny: potężne, wąskie i celowo reglamentowane.

Powiązane