Gemini Omni
Terug naar alle artikelen
8 min leestijd

Google kondigt Gemini 3.6 Flash, 3.5 Flash-Lite en 3.5 Flash Cyber aan: alles wat je moet weten

Google lanceert Gemini 3.6 Flash, 3.5 Flash-Lite en 3.5 Flash Cyber. Prijzen, benchmarks, beschikbaarheid, veiligheid en de Gemini 4-roadmap — de volledige analyse.

Gemini 3.6 FlashGemini 3.5 Flash-LiteGemini 3.5 Flash CyberModelsAnnouncement2026Nederlands

Drie nieuwe Flash-modellen op één dag

Op 21 juli 2026 kondigde Google drie nieuwe Gemini-modellen in één keer aan: Gemini 3.6 Flash, Gemini 3.5 Flash-Lite en Gemini 3.5 Flash Cyber. De rode draad is onmiskenbaar — elk model richt zich op hetzelfde probleem dat ontwikkelaars steeds weer aankaarten: AI-agents in productie hebben hogere token-efficiëntie, lagere latentie en betrouwbaardere prestaties nodig, niet alleen hogere scores voor de bühne.

Dit artikel legt uit waar elk model voor dient, wat het kost, waar je het vandaag al kunt gebruiken en wat Google over de toekomst prijsgaf (spoiler: Gemini 3.5 Pro wordt getest met partners, en de pre-training van Gemini 4 is al gestart). Alle cijfers komen uit de officiële aankondiging.

De line-up in één oogopslag

ModelRolKerngetalToegang
Gemini 3.6 FlashWerkpaard: coderen, kenniswerk, multimodaal17% minder outputtokens dan 3.5 Flash, tegen een lagere prijsVandaag algemeen beschikbaar
Gemini 3.5 Flash-LiteSnelste, meest kostenefficiënte model in de 3.5-klasse350 outputtokens/s (Artificial Analysis)Vandaag algemeen beschikbaar
Gemini 3.5 Flash CyberBeveiligingsspecialist voor het vinden en verhelpen van kwetsbaarhedenFrontier-competitief op CyberGym binnen CodeMenderAlleen pilot met beperkte toegang

Gemini 3.6 Flash: het nieuwe werkpaard

3.6 Flash bouwt rechtstreeks voort op feedback van ontwikkelaars op 3.5 Flash. De boodschap is ongebruikelijk voor een modellancering: het is niet alleen beter, het is zuiniger. Op de Artificial Analysis Index verbruikt het 17% minder outputtokens dan 3.5 Flash, en op sommige benchmarks — zoals DeepSWE van Datacurve — zag Google reducties van tot wel 65%. Het heeft ook minder redeneerstappen en toolaanroepen nodig om meerstaps-workflows af te ronden, wat zich optelt tot echte besparingen bij agentische taken.

Benchmarkwinst van Gemini 3.6 Flash ten opzichte van 3.5 Flash op DeepSWE, MLE Bench, OSWorld-Verified en GDPval-AA v2

De belangrijkste benchmarks ten opzichte van 3.5 Flash:

BenchmarkGemini 3.6 FlashGemini 3.5 Flash
DeepSWE (agentisch coderen)49%37%
MLE Bench (ML-onderzoek)63.9%49.7%
OSWorld-Verified (computergebruik)83.0%78.4%
GDPval-AA v2 (kenniswerk)14211349

Twee andere lanceringsdetails zijn belangrijk voor bouwers:

  • Computergebruik is nu een ingebouwde client-side tool via de Gemini API en Gemini Enterprise — geen aparte scaffolding meer nodig.
  • Vroege klanten zijn onder meer Figma, Harvey, Hebbia en JetBrains; Hebbia en Harvey noemen expliciet multimodale sterktes zoals documentverwerking, grafiek- en data-analyse en het opstellen van rapporten.

Googles demo van de token-efficiëntie naast elkaar op een OSWorld-taak is het bekijken waard: token-efficiëntiedemo 3.6 Flash vs 3.5 Flash (video).

Voor de volledige vergelijking, zie onze diepgaande analyse Gemini 3.6 Flash vs 3.5 Flash.

Gemini 3.5 Flash-Lite: gebouwd om agentische workflows te schalen

Flash-Lite is de volumekaart. Het is het snelste model in de 3.5-serie met 350 outputtokens per seconde (Artificial Analysis), gericht op agentisch zoeken, documentverwerking en elke pipeline waar doorvoer de bottleneck is.

De kwaliteitssprong ten opzichte van 3.1 Flash-Lite is spectaculair — Terminal-Bench 2.1 op 54% versus 31%, GDM-MRCR v2 long-context op 72.2% versus 60.1% en GDPval-AA v2 op 1140 versus 642. Opmerkelijk genoeg verslaat het zelfs het grotere Gemini 3 Flash op meerdere agentische evals, waaronder SWE-Bench Pro (54.2% versus 49.6%) en OSWorld-Verified (74.0% versus 65.1%).

Het wordt geleverd met configureerbare denkniveaus — draai minimal/low voor latentiekritische taken met hoog volume, of zet het niveau hoger voor meerstaps-subagentworkloads — en ook hier is computergebruik ingebouwd. Vroege klanten zijn onder meer Ashler, Palo Alto Networks en Ramp, en het model wordt uitgerold binnen Google Search en de Gemini-app.

Onze gids voor agentische workflows met 3.5 Flash-Lite behandelt denkniveaus, kostenberekeningen en modelkeuze in de diepte.

Prijzen: goedkoper op beide niveaus

ModelInput ($/1M tokens)Output ($/1M tokens)Opmerkingen
Gemini 3.6 Flash$1.50$7.50Lager dan 3.5 Flash, plus ~17% minder outputtokens
Gemini 3.5 Flash-Lite$0.30$2.50Beste prijs-prestatieverhouding voor verkeer met hoge doorvoer
Gemini 3.5 Flash CyberGeen publieke prijs; pilot met beperkte toegang via CodeMender

Het echte kostenverhaal zit in de vermenigvuldiging: 3.6 Flash rekent minder per token en produceert minder tokens per taak, dus de effectieve kosten per agentische taak dalen sterker dan de prijslijst suggereert.

Gemini 3.5 Flash Cyber: een specialist achter een fluwelen koord

Het derde model is anders. 3.5 Flash Cyber is gebouwd op 3.5 Flash en gefinetuned voor het vinden en verhelpen van beveiligingskwetsbaarheden tegen een lagere prijs per token dan grotere modellen. Het draait binnen CodeMender, Googles codebeveiligingsagent, waar meerdere 3.5 Flash Cyber-agents samenwerken om één gecombineerd rapport op te leveren — met frontier-competitieve prestaties op de CyberGym-benchmark.

CyberGym-benchmarkresultaten van Gemini 3.5 Flash Cyber binnen CodeMender

Omdat de technologie tweeërlei bruikbaar is, brengt Google haar bewust niet breed uit: ze wordt exclusief beschikbaar voor overheden en vertrouwde partners via CodeMender, als onderdeel van een pilot met beperkte toegang. Het doel is verdedigers in de frontlinie een voorsprong te geven bij het patchen van kritieke kwetsbaarheden voordat ze worden misbruikt.

Veiligheid: minder jailbreaks, minder weigeringen

3.6 Flash wordt geleverd met versterkte Frontier Safety-waarborgen voor misbruik op het gebied van CBRN (chemisch, biologisch, radiologisch, nucleair) en cyberaanvallen. Volgens Google is het model aanzienlijk beter bestand tegen jailbreaks en tegelijkertijd getraind om weigeringen bij legitiem gebruik te minimaliseren — precies de combinatie die ontwikkelaars willen, in plaats van een botte alles-weigeren-houding.

Waar je ze vandaag kunt gebruiken

OmgevingGemini 3.6 FlashGemini 3.5 Flash-Lite
Gemini API (Google AI Studio, Android Studio)
Google Antigravity
Gemini Enterprise Agent Platform
Gemini Enterprise-app
Gemini-app
Google Search✅ Wordt uitgerold
CodeMender (3.5 Flash Cyber)Beperkte pilot: alleen overheden en vertrouwde partners

De roadmap-teaser: 3.5 Pro en Gemini 4

Twee vooruitblikkende opmerkingen, wat verstopt in de aankondiging, verdienen aandacht:

  1. Gemini 3.5 Pro wordt momenteel getest met partners, met brede beschikbaarheid gepland „zodra het klaar is”.
  2. Google is begonnen aan zijn meest ambitieuze pre-trainingsrun ooit — voor Gemini 4 — en zegt „enthousiast te zijn over de voortgang”.

Samen gelezen lijken de Flash-releases op het vastzetten van de efficiëntielaag vóór de volgende sprong naar de frontier.

Kortom

Bouw je agents, dan is dit een zeldzame lancering waarbij de juiste keuze voor de hand ligt: 3.6 Flash voor kwaliteitsgevoelig agentisch werk, 3.5 Flash-Lite voor hoge volumes, beide goedkoper dan wat ze vervangen. Flash Cyber laat intussen zien waar Google denkt dat gespecialiseerde finetunes naartoe gaan — krachtig, smal en bewust afgeschermd.

Gerelateerd