Google kondigt Gemini 3.6 Flash, 3.5 Flash-Lite en 3.5 Flash Cyber aan: alles wat je moet weten
Google lanceert Gemini 3.6 Flash, 3.5 Flash-Lite en 3.5 Flash Cyber. Prijzen, benchmarks, beschikbaarheid, veiligheid en de Gemini 4-roadmap — de volledige analyse.
Drie nieuwe Flash-modellen op één dag
Op 21 juli 2026 kondigde Google drie nieuwe Gemini-modellen in één keer aan: Gemini 3.6 Flash, Gemini 3.5 Flash-Lite en Gemini 3.5 Flash Cyber. De rode draad is onmiskenbaar — elk model richt zich op hetzelfde probleem dat ontwikkelaars steeds weer aankaarten: AI-agents in productie hebben hogere token-efficiëntie, lagere latentie en betrouwbaardere prestaties nodig, niet alleen hogere scores voor de bühne.
Dit artikel legt uit waar elk model voor dient, wat het kost, waar je het vandaag al kunt gebruiken en wat Google over de toekomst prijsgaf (spoiler: Gemini 3.5 Pro wordt getest met partners, en de pre-training van Gemini 4 is al gestart). Alle cijfers komen uit de officiële aankondiging.
De line-up in één oogopslag
| Model | Rol | Kerngetal | Toegang |
|---|---|---|---|
| Gemini 3.6 Flash | Werkpaard: coderen, kenniswerk, multimodaal | 17% minder outputtokens dan 3.5 Flash, tegen een lagere prijs | Vandaag algemeen beschikbaar |
| Gemini 3.5 Flash-Lite | Snelste, meest kostenefficiënte model in de 3.5-klasse | 350 outputtokens/s (Artificial Analysis) | Vandaag algemeen beschikbaar |
| Gemini 3.5 Flash Cyber | Beveiligingsspecialist voor het vinden en verhelpen van kwetsbaarheden | Frontier-competitief op CyberGym binnen CodeMender | Alleen pilot met beperkte toegang |
Gemini 3.6 Flash: het nieuwe werkpaard
3.6 Flash bouwt rechtstreeks voort op feedback van ontwikkelaars op 3.5 Flash. De boodschap is ongebruikelijk voor een modellancering: het is niet alleen beter, het is zuiniger. Op de Artificial Analysis Index verbruikt het 17% minder outputtokens dan 3.5 Flash, en op sommige benchmarks — zoals DeepSWE van Datacurve — zag Google reducties van tot wel 65%. Het heeft ook minder redeneerstappen en toolaanroepen nodig om meerstaps-workflows af te ronden, wat zich optelt tot echte besparingen bij agentische taken.

De belangrijkste benchmarks ten opzichte van 3.5 Flash:
| Benchmark | Gemini 3.6 Flash | Gemini 3.5 Flash |
|---|---|---|
| DeepSWE (agentisch coderen) | 49% | 37% |
| MLE Bench (ML-onderzoek) | 63.9% | 49.7% |
| OSWorld-Verified (computergebruik) | 83.0% | 78.4% |
| GDPval-AA v2 (kenniswerk) | 1421 | 1349 |
Twee andere lanceringsdetails zijn belangrijk voor bouwers:
- Computergebruik is nu een ingebouwde client-side tool via de Gemini API en Gemini Enterprise — geen aparte scaffolding meer nodig.
- Vroege klanten zijn onder meer Figma, Harvey, Hebbia en JetBrains; Hebbia en Harvey noemen expliciet multimodale sterktes zoals documentverwerking, grafiek- en data-analyse en het opstellen van rapporten.
Googles demo van de token-efficiëntie naast elkaar op een OSWorld-taak is het bekijken waard: token-efficiëntiedemo 3.6 Flash vs 3.5 Flash (video).
Voor de volledige vergelijking, zie onze diepgaande analyse Gemini 3.6 Flash vs 3.5 Flash.
Gemini 3.5 Flash-Lite: gebouwd om agentische workflows te schalen
Flash-Lite is de volumekaart. Het is het snelste model in de 3.5-serie met 350 outputtokens per seconde (Artificial Analysis), gericht op agentisch zoeken, documentverwerking en elke pipeline waar doorvoer de bottleneck is.
De kwaliteitssprong ten opzichte van 3.1 Flash-Lite is spectaculair — Terminal-Bench 2.1 op 54% versus 31%, GDM-MRCR v2 long-context op 72.2% versus 60.1% en GDPval-AA v2 op 1140 versus 642. Opmerkelijk genoeg verslaat het zelfs het grotere Gemini 3 Flash op meerdere agentische evals, waaronder SWE-Bench Pro (54.2% versus 49.6%) en OSWorld-Verified (74.0% versus 65.1%).
Het wordt geleverd met configureerbare denkniveaus — draai minimal/low voor latentiekritische taken met hoog volume, of zet het niveau hoger voor meerstaps-subagentworkloads — en ook hier is computergebruik ingebouwd. Vroege klanten zijn onder meer Ashler, Palo Alto Networks en Ramp, en het model wordt uitgerold binnen Google Search en de Gemini-app.
Onze gids voor agentische workflows met 3.5 Flash-Lite behandelt denkniveaus, kostenberekeningen en modelkeuze in de diepte.
Prijzen: goedkoper op beide niveaus
| Model | Input ($/1M tokens) | Output ($/1M tokens) | Opmerkingen |
|---|---|---|---|
| Gemini 3.6 Flash | $1.50 | $7.50 | Lager dan 3.5 Flash, plus ~17% minder outputtokens |
| Gemini 3.5 Flash-Lite | $0.30 | $2.50 | Beste prijs-prestatieverhouding voor verkeer met hoge doorvoer |
| Gemini 3.5 Flash Cyber | — | — | Geen publieke prijs; pilot met beperkte toegang via CodeMender |
Het echte kostenverhaal zit in de vermenigvuldiging: 3.6 Flash rekent minder per token en produceert minder tokens per taak, dus de effectieve kosten per agentische taak dalen sterker dan de prijslijst suggereert.
Gemini 3.5 Flash Cyber: een specialist achter een fluwelen koord
Het derde model is anders. 3.5 Flash Cyber is gebouwd op 3.5 Flash en gefinetuned voor het vinden en verhelpen van beveiligingskwetsbaarheden tegen een lagere prijs per token dan grotere modellen. Het draait binnen CodeMender, Googles codebeveiligingsagent, waar meerdere 3.5 Flash Cyber-agents samenwerken om één gecombineerd rapport op te leveren — met frontier-competitieve prestaties op de CyberGym-benchmark.

Omdat de technologie tweeërlei bruikbaar is, brengt Google haar bewust niet breed uit: ze wordt exclusief beschikbaar voor overheden en vertrouwde partners via CodeMender, als onderdeel van een pilot met beperkte toegang. Het doel is verdedigers in de frontlinie een voorsprong te geven bij het patchen van kritieke kwetsbaarheden voordat ze worden misbruikt.
Veiligheid: minder jailbreaks, minder weigeringen
3.6 Flash wordt geleverd met versterkte Frontier Safety-waarborgen voor misbruik op het gebied van CBRN (chemisch, biologisch, radiologisch, nucleair) en cyberaanvallen. Volgens Google is het model aanzienlijk beter bestand tegen jailbreaks en tegelijkertijd getraind om weigeringen bij legitiem gebruik te minimaliseren — precies de combinatie die ontwikkelaars willen, in plaats van een botte alles-weigeren-houding.
Waar je ze vandaag kunt gebruiken
| Omgeving | Gemini 3.6 Flash | Gemini 3.5 Flash-Lite |
|---|---|---|
| Gemini API (Google AI Studio, Android Studio) | ✅ | ✅ |
| Google Antigravity | ✅ | — |
| Gemini Enterprise Agent Platform | ✅ | ✅ |
| Gemini Enterprise-app | ✅ | — |
| Gemini-app | ✅ | ✅ |
| Google Search | — | ✅ Wordt uitgerold |
| CodeMender (3.5 Flash Cyber) | Beperkte pilot: alleen overheden en vertrouwde partners |
De roadmap-teaser: 3.5 Pro en Gemini 4
Twee vooruitblikkende opmerkingen, wat verstopt in de aankondiging, verdienen aandacht:
- Gemini 3.5 Pro wordt momenteel getest met partners, met brede beschikbaarheid gepland „zodra het klaar is”.
- Google is begonnen aan zijn meest ambitieuze pre-trainingsrun ooit — voor Gemini 4 — en zegt „enthousiast te zijn over de voortgang”.
Samen gelezen lijken de Flash-releases op het vastzetten van de efficiëntielaag vóór de volgende sprong naar de frontier.
Kortom
Bouw je agents, dan is dit een zeldzame lancering waarbij de juiste keuze voor de hand ligt: 3.6 Flash voor kwaliteitsgevoelig agentisch werk, 3.5 Flash-Lite voor hoge volumes, beide goedkoper dan wat ze vervangen. Flash Cyber laat intussen zien waar Google denkt dat gespecialiseerde finetunes naartoe gaan — krachtig, smal en bewust afgeschermd.