Drie weken na de lancering van Gemini 3.7 Flash presenteert Google alweer een opvolger. Gemini 3.8 Flash is volgens het bedrijf het beste redeneer- en codeermodel uit de Flash-familie tot nu toe, met dezelfde snelheid en prijs als zijn voorganger. Je betaalt 0,75 dollar per miljoen inputtokens en 3,75 dollar per miljoen outputtokens. Tegelijk introduceert Google Gemini 3.8 Flash Cyber, een variant die is getraind voor cybersecurity en voorlopig alleen beschikbaar is voor geverifieerde verdedigers. Het is al de derde Flash-release in zes weken tijd.
Wat is er nieuw in Gemini 3.8 Flash
De grootste sprongen zitten in software engineering, agentic taken en meerstapsredenering in gespecialiseerde domeinen. Op DeepSWE v1.1, een benchmark voor software engineering over lange trajecten, lost 3.8 Flash complexe engineeringproblemen autonoom van begin tot eind op. Daarmee verslaat het model de meeste grotere frontier-modellen, terwijl de kosten een fractie bedragen van wat die modellen rekenen.
Ook in professionele kennisdomeinen scoort het model beter dan zijn voorganger en dan concurrerende frontier-modellen. Dat geldt voor Vals Finance Agent V2 in de financiële sector en voor Harvey’s Legal Agent Benchmark voor juridisch werk. Op HLE-Verified, dat meerstapsredenering meet over exacte wetenschappen, geesteswetenschappen en beroepsvelden, haalt 3.8 Flash 54,9 procent.
Onafhankelijke metingen bevestigen de vooruitgang. Artificial Analysis noteert een Intelligence Index van 59 voor de hoogste denkstand, met een outputsnelheid van 327 tokens per seconde. Bij Arena.ai debuteert het model op plaats 7 in de Text Arena, voor Claude Opus 5, en op plaats 14 in de Agent Arena, boven DeepSeek-V4-Pro. Ter vergelijking: Gemini 3.7 Flash staat daar op plek 32.
Het model werkt harder en dat kost soms meer tokens
De prestatiewinst komt uit een bewuste ontwerpkeuze: 3.8 Flash werkt harder. Bij complexe taken voert het model extra redeneerstappen uit en roept het tools meerdere keren achter elkaar aan. Vooral in de hogere denkstanden verbruikt het daardoor meer tokens om de kwaliteit te maximaliseren.
Je stuurt dat zelf via de instelbare effort levels low, medium en high. Draait jouw toepassing om rekenefficiëntie, dan kies je een lagere stand om het tokenverbruik te beperken. Ook blijft Gemini 3.7 Flash volledig ondersteund voor workloads waarin efficiëntie voorop staat. De specificaties, een contextvenster van 1 miljoen tokens, een outputlimiet van 64.000 tokens en invoer van tekst, afbeeldingen, audio, video en pdf-bestanden.
Wat 3.8 Flash in de praktijk bouwt
Google laat de capaciteiten zien met demo’s uit Google Antigravity en AI Studio. Met één simpele prompt en een loop-instructie bouwde het model een compleet 3D-spel waarin je als tovenaar door een kasteel navigeert, met puzzels, environmental storytelling en texturen die zijn gegenereerd met Nano Banana. Een andere prompt leverde een volledig werkende DOS-versie van Google Maps op.
Ook voor datavisualisatie blijkt het model bruikbaar. Het bouwde een topografische kaart van bekende geografische locaties op basis van datasets van de U.S. Geological Survey. In AI Studio maakte het Hardware Anatomy. Dit is een interactieve 3D-visualizer die apparaten met Three.js uit mekaar haalt.
Gemini 3.8 Flash Cyber richt zich op verdedigers
Gemini 3.8 Flash Cyber is intensief getraind voor cybersecurity en die training heeft volgens Google ook bijgedragen aan de redeneer- en codeerwinst van het standaardmodel. Op CyberGym, de standaardbenchmark voor het vinden van kwetsbaarheden, scoort het model 86,2 procent. Daarmee overtreft het zowel 3.5 Flash Cyber als aanzienlijk grotere frontier-modellen.
Omdat CyberGym zich beperkt tot C en C++, testte Google het model ook op een interne benchmark met complexe codebases in twintig programmeertalen. Daar ontdekte 3.8 Flash Cyber meer dan 70 procent van de kwetsbaarheden. Op CWE-Bench, een externe benchmark voor het patchen van kwetsbaarheden, haalt het model een pass@1 van 47,2 procent. Dat staat naast de 47,8 procent van een toonaangevend frontier-model, maar dan tegen een veel lagere prijs. Google heeft bewust geïnvesteerd in het verhelpen van kwetsbaarheden en dat geprioriteerd boven offensieve capaciteiten zoals exploitatie.
De impact is bij Google zelf al zichtbaar
Het Chrome Security-team stelde vast dat 3.8 Flash Cyber 2,6 keer meer correcte patches produceerde voor kwetsbaarheden in Chrome dan de beste commerciële modellen, die veel groter zijn. Engineering director Doug Turner vertelt dat het model zelfs een bug vond die al dertien jaar in Chromium en Chrome zat. Turner spreekt van een “vulnerability apocalypse” sinds generatieve AI het aantal gemelde kwetsbaarheden in een hockeystickcurve heeft doen stijgen.
Beveiligingsbedrijf Wiz mat op zijn interne pentestbenchmark een 7,5 tot 9,7 procent hogere recall dan bij andere toonaangevende modellen, tegen 2,3 tot 5,2 keer lagere kosten. Het Cloud Vulnerability Research-team van Google vond met 3.8 Flash Cyber in minder dan twee uur een kritieke fundamentele kwetsbaarheid waarvoor onderzoek normaal gesproken maanden duurt.
Een aanvaller hoeft in miljoenen regels code maar één ernstige fout te vinden. Een verdediger moet ze allemaal verwijderen. Een snel en betaalbaar model dat kwetsbaarheden opspoort en repareert, verschuift die verhouding in het voordeel van de verdediger.
Veiligheid, beperkingen en het Fairwind Program
Gemini 3.8 Flash wordt uitgerold met waarborgen tegen misbruik op het gebied van CBRN en cyberaanvallen, in lijn met het Frontier Safety Framework. Flash Cyber krijgt ruimere vrijheden voor security-taken en is daarom alleen toegankelijk via het nieuwe Fairwind Program. Dat programma geeft overheidsinstanties, beheerders van kritieke infrastructuur en beheerders van software voorrangstoegang, na een aanvraagprocedure.
Volgens metingen van Gray Swan hebben de 3.8-modellen een flinke sprong gemaakt in robuustheid tegen prompt injection. De model card laat verder zien dat de veiligheidsprestaties vergelijkbaar zijn met die van 3.7 Flash, met een lichte terugval in niet-Engelstalige veiligheidsevaluaties. De kennis van het model loopt door tot maart 2026.
Beschikbaarheid en prijzen
Developers bouwen met 3.8 Flash via de Gemini API in Google AI Studio en Android Studio, verkennen agent-workflows in Google Antigravity of genereren interfaces in Stitch. De stabiele modelnaam is gemini-3.8-flash, met ondersteuning voor de Batch API en voor flex en priority inference. Bedrijven krijgen toegang via Gemini Enterprise. Consumenten met een Google AI Pro- of Ultra-abonnement gebruiken het model in de Gemini-app, in AI Mode van Google Search en in Gemini in Google Sheets. Voor Flash Cyber moet je je aanmelden voor het Fairwind Program.
Tempo
Drie Flash-releases in zes weken zeggen meer dan de afzonderlijke benchmarks. De kloof tussen betaalbare Flash-modellen en dure frontier-modellen wordt met elke cyclus kleiner, terwijl de prijs gelijk blijft. Wie met AI bouwt, doet er daarom goed aan effort levels te testen tegen de eigen workload in plaats van automatisch het duurste model te kiezen.