21 juli 2026
Google heeft vandaag Gemini 3.6 Flash uitgebracht. Het model is goedkoper dan zijn voorganger en scoort op vrijwel elke test beter dan Gemini 3.1 Pro, het grote model van een paar maanden geleden. Dat klinkt als een detail voor techneuten, maar juist deze middenklasse-modellen doen het meeste werk in de apps en tools die jij dagelijks gebruikt.
Gemini 3.6 Flash is per direct te gebruiken in Google AI Studio en via de Gemini API. Dit is Googles eigen launch-video:
Wat is Gemini 3.6 Flash precies?
Google verdeelt zijn Gemini-modellen in drie lijnen. Pro is het grote, dure model. Flash is de snelle middenklasse. Flash-Lite is de budgetversie. Gemini 3.6 Flash is de opvolger van 3.5 Flash, dat in de lente uitkwam.
Het opvallende aan deze release: het middenklasse-model verslaat nu het vorige topmodel. Gemini 3.6 Flash scoort op alle door Google gepubliceerde tests hoger dan Gemini 3.1 Pro, terwijl het per gebruik minder kost. Die trend zie je bij elke modelgeneratie terug: wat een half jaar geleden top was, zit nu in de middenmoot.
Wat kost het?
AI-modellen rekenen af per miljoen tokens. Een token is een stukje tekst, ongeveer driekwart woord. Je betaalt apart voor invoer (wat jij het model geeft) en uitvoer (wat het model terugschrijft).
| Model | Invoer per 1M tokens | Uitvoer per 1M tokens |
|---|---|---|
| Gemini 3.6 Flash | $1,50 | $7,50 |
| Gemini 3.5 Flash | $1,50 | $9,00 |
| Gemini 3.1 Pro | $2,00 | $12,00 |
| GPT-5.6 Luna | $1,00 | $6,00 |
| Grok 4.5 | $2,00 | $6,00 |
| Claude Sonnet 5 | $3,00 | $15,00 |
De uitvoerprijs zakt van $9,00 naar $7,50, zo’n 17 procent goedkoper dan de voorganger. Let wel: Anthropic geeft op Sonnet 5 tijdelijk korting ($2,00 invoer, $10,00 uitvoer) en OpenAI’s GPT-5.6 Luna blijft met $6,00 uitvoer de goedkoopste van dit rijtje.
Waar is het goed in?
Op drie punten staat Gemini 3.6 Flash bovenaan de vergelijkingstabel die Google zelf publiceerde, ook boven de duurdere concurrenten:
- Een computer bedienen. Op OSWorld-Verified, een test waarin het model zelfstandig met muis en toetsenbord programma’s bedient, haalt het 83,0 procent. Claude Sonnet 5 zit op 81,2 procent, GPT-5.6 Luna op 72,6 procent.
- Grafieken en documenten lezen. Op CharXiv Reasoning, waarbij het model informatie uit complexe grafieken moet halen, scoort het 85,2 procent zonder hulpmiddelen. Dat is de hoogste score in de tabel.
- Lange documenten onthouden. Op de langecontext-test GDM-MRCR haalt het 91,8 procent bij 128.000 tokens context. Sonnet 5 blijft daar steken op 71,6 procent. Bij één miljoen tokens context is Gemini 3.6 Flash het enige model in de vergelijking met een score (54,0 procent).
Vooral dat laatste is voor gewone gebruikers merkbaar. Een model dat lange documenten goed vasthoudt, raakt in een lang gesprek of bij een dik PDF-bestand minder snel de draad kwijt.
Waar winnen andere modellen?
Eerlijk is eerlijk: voor programmeerwerk is dit niet het beste model. Op DeepSWE, een test voor langdurige softwareklussen, haalt GPT-5.6 Luna 67 procent tegen 49 procent voor Gemini 3.6 Flash. Op SWE-Bench Pro staat Grok 4.5 bovenaan met 64,7 procent, gevolgd door Sonnet 5 (63,2) en Luna (62,7). Gemini 3.6 Flash komt tot 58,7 procent.
Ook op algemeen kenniswerk (GDPVal-AA, een ranglijst met Elo-punten zoals bij schaken) staan Sonnet 5 (1607) en Luna (1584) duidelijk boven Gemini 3.6 Flash (1421). Wie het beste model voor code of complexe kantoortaken zoekt, zit bij de concurrentie dus nog steeds beter. En omdat Luna goedkoper is, wint Google hier niet automatisch op prijs.
Minder tokens voor hetzelfde werk
Naast de lagere prijs per token is het model zuiniger geworden. Voor dezelfde programmeertest gebruikte 3.5 Flash gemiddeld 276.000 uitvoertokens per taak; 3.6 Flash doet het met 97.000. Dat is bijna een derde. Omdat je per token betaalt, dalen je kosten dus dubbel: lagere prijs én minder verbruik. Antwoorden komen daardoor ook sneller.
Ook nieuw: Gemini 3.5 Flash-Lite
Tegelijk verscheen een nieuwe budgetversie, Gemini 3.5 Flash-Lite. Die kost $0,30 per miljoen invoertokens en $2,50 per miljoen uitvoertokens. Op de meeste tests verslaat hij Claude Haiku 4.5, dat ruim drie keer zo duur is in gebruik. OpenAI’s GPT-5.4 mini blijft op programmeertests wel beter. Voor simpel bulkwerk, zoals teksten samenvatten of gegevens sorteren, is dit soort mini-modellen vaak al genoeg.
Wat merk jij hiervan?
Gemini 3.6 Flash is geen doorbraak, maar een degelijke stap: beter én goedkoper dan de voorganger, sterk in computerbediening en lange documenten, middenmoot in programmeren. De echte les is breder. AI-prijzen dalen elke paar maanden terwijl de kwaliteit stijgt, en per taak verschilt welk model wint. Hoe die afweging bij OpenAI uitpakt, lees je in ons stuk over GPT-5.6 Sol. En dat de concurrentie ook uit China komt, zag je eerder bij Kimi K3.