Google bracht op 2 september Gemini 3.8 Flash uit, drie weken na 3.7 Flash en zes weken na de Flash daarvóór (Bron: Google). Interessanter dan het tempo is wat er níet bij zat: er is een tweede versie, gebouwd om beveiligingslekken op te sporen, en die krijg jij niet.
Wat is er nieuw aan Gemini 3.8 Flash?
Het korte antwoord: hetzelfde prijskaartje, meer doorzettingsvermogen. Google houdt de introductieprijs van 3.7 Flash aan — 0,75 dollar per miljoen invoertokens, 3,75 per miljoen uitvoertokens — en belooft betere prestaties bij programmeren, bij taken waarin het model zelfstandig stappen achter elkaar zet, en bij redeneren dat meerdere tussenstappen vraagt.
Die winst komt ergens vandaan. Google beschrijft het zelf als een ontwerpkeuze: het model werkt harder. Op ingewikkelde taken zet het extra redeneerstappen en roept het vaker gereedschap aan. Dat kost tokens. Voor eenvoudige klussen op groot volume kan 3.8 dus duurder uitvallen dan 3.7, en Google raadt daar zelf aan om een lager effort-niveau te kiezen of bij de oude versie te blijven.
Op benchmarks scoort het model 54,9 procent op HLE-Verified, een toets die meerstapsredeneren over uiteenlopende vakgebieden meet. Bij vergelijkingen op financiële en juridische taken wint het volgens Google van 3.7 Flash en van grotere concurrenten. Dat zijn cijfers van de maker, met alles wat daarbij hoort.
Beginner-tipEentokenis ongeveer een woorddeel; ruwweg 750 woorden per 1.000 tokens. De prijzen hierboven gaan dus over miljoenen woorden, niet over losse vragen. Als je gewoon de Gemini-app gebruikt, betaal je niets per token — dat zit in je abonnement.
Let op de vervaldatum van de prijs
In een voetnoot onder de aankondiging staat het echte prijsverhaal. De genoemde tarieven zijn introductieprijzen en gelden tot en met 31 december 2026. Vanaf 1 januari 2027 gaat het naar 1,50 dollar per miljoen invoertokens en 7,50 per miljoen uitvoertokens (Bron: Google).
Een verdubbeling, met een datum erbij. Wie nu een begroting maakt voor iets dat volgend jaar nog draait, rekent beter meteen met het hogere bedrag. Het patroon is niet nieuw: prijsvergelijkingen tussen AI-modellen verouderen sneller dan de modellen zelf.
Waarom gaat de cyberversie alleen naar overheden?
Gemini 3.8 Flash Cyber is getraind om kwetsbaarheden in software te vinden en te repareren. Google claimt daar concrete resultaten mee: het Chrome-beveiligingsteam kreeg 2,6 keer zoveel correcte patches uit dit model als uit de beste commerciële modellen die veel groter zijn, en een intern onderzoeksteam vond een kritieke kwetsbaarheid binnen twee uur waar zulk speurwerk normaal maanden kost.
Toegang loopt via het Fairwind Program, en dat is expliciet begrensd: overheidsinstanties, beheerders van kritieke infrastructuur en onderhouders van software kunnen toegang aanvragen (Bron: Google DeepMind). Om welke overheden het gaat, zegt Google niet.
De reden die het bedrijf geeft, is eerlijk genoeg. Datzelfde denken zagen we eerder terug toen OpenAI zijn beveiliging aanscherpte na een inbraak in een testomgeving: hoe capabeler het model, hoe smaller de kring die erbij mag. Het gewone 3.8 Flash heeft veiligheidsremmen tegen misbruik op het gebied van chemische, biologische, radiologische en nucleaire kennis, en tegen aanvallend cybergebruik. De Cyber-variant heeft “een ruimere set mitigaties” — vriendelijk geformuleerd voor: minder rem. Een model dat lekken kan vinden om ze te dichten, kan ze net zo goed vinden om erdoorheen te kruipen.
GevorderdenOp CWE-Bench, een externe test voor patch-kwaliteit, haalt 3.8 Flash Cyber 47,2 procent pass@1 tegen 47,8 procent voor een toonaangevend groter model — vergelijkbaar dus, tegen fors lagere kosten. De interessantere claim is de interne benchmark over twintig programmeertalen, waar het model boven de 70 procent uitkomt. Die test is niet publiek, dus onafhankelijk verifiëren kan niet.
Wat betekent dat voor de rest van internet?
Hier zit de vraag die de aankondiging onbeantwoord laat. Als het beste gereedschap om lekken te vinden voorbehouden blijft aan overheden en geselecteerde partners, wie repareert dan de software die daar niet onder valt? De open source-bibliotheken waar je bank op draait, de webshop van de zaak om de hoek, het contentmanagementsysteem van je vereniging.
Google noemt onderhouders van software wel expliciet als doelgroep voor Fairwind, wat het gat kleiner maakt. Maar aanvragen is iets anders dan krijgen, en een klein project met twee vrijwilligers loopt zelden voorop in zo’n procedure.
Er is ook een spiegelbeeld: dezelfde beperking is precies wat voorkomt dat het model een cadeautje wordt voor wie kwaad wil. Er is geen versie van dit besluit waarin iedereen tevreden is. Dat AI-beveiligingsgereedschap ongelijk verdeeld raakt, is wel iets om in de gaten te houden, en het past in een breder patroon dat we eerder zagen bij de leiderschapswissel boven Gemini: Google zet zwaar in op AI-veiligheid als onderscheidend punt.
Wat merk jij ervan?
Heb je Google AI Pro of Ultra, dan gebruik je 3.8 Flash nu al — in de Gemini-app, in AI Mode binnen Search en in Gemini in Google Sheets. Je hoeft niets aan te zetten. Wat je waarschijnlijk merkt, is dat langere klussen vaker in één keer afgemaakt worden.
Zit je op het gratis plan, dan verandert er voorlopig niets. En wil je juist mínder AI in je dagelijkse software, dan is de gids om AI overal uit te zetten nuttiger dan welke modelrelease ook.
Voor ontwikkelaars: 3.7 Flash blijft ondersteund. Er is geen migratiedeadline aangekondigd. De enige datum die je in je agenda hoeft te zetten is 31 december 2026, wanneer die introductieprijs afloopt.
