Google rijdt met zijn Flash-lijn op twee sporen. Gemini 3.8 Flash is het werkmodel voor programmeren en analyses, Gemini 3.5 Flash Lite het snelle model voor eenvoudige taken. Op ChatX zijn ze allebei beschikbaar, Flash Lite ook voor gasten. De tabel laat de verschillen zien. Daaronder staat wanneer welk model de betere keuze is.
Gemini 3.8 Flash en 3.5 Flash Lite in het kort
| Gemini 3.8 Flash | Gemini 3.5 Flash Lite | |
|---|---|---|
| Gericht op | programmeren, analyses met meerdere stappen, vakvragen | snelheid en doorvoer bij eenvoudige taken |
| Contextvenster | 1 miljoen tokens | 1 miljoen tokens |
| Denkdiepte | instelbaar vanaf «Laag», niet uit te schakelen | vast, niet instelbaar |
| Beeldbegrip / zoeken op het web | ja / ja | ja / ja |
| Prijs per token bij de aanbieder | ≈ 1,5× Flash Lite, ≈ ⅕ van GPT-5.6 Sol | een van de goedkoopste modellen |
| Beschikbaar voor | geregistreerde gebruikers | gasten en geregistreerde gebruikers |
Wat 3.8 Flash onderscheidt van 3.7 Flash
Google beschrijft het verschil zo: bij complexe taken zet 3.8 Flash extra denkstappen en roept het gereedschap zoals zoeken op het web opnieuw aan, in plaats van na de eerste poging te stoppen. Dat blijkt uit de tests. Bij DeepSWE, een test voor softwaretaken die het model zelf afhandelt, staat 3.8 Flash voor de meeste grotere topmodellen. Bij HLE-Verified, een brede kennis- en analysetest, haalt het 54,9 procent. Bij financiële en juridische taken (Vals Finance Agent, Harvey Legal Agent) doet het duidelijk beter dan 3.7 Flash.
De keerzijde: meer denkstappen betekent meer tokens per antwoord. Wie alleen een kort gegeven wil, betaalt voor grondigheid die niet nodig was. De denkdiepte kan omlaag naar «Laag», maar bij 3.8 Flash gaat ze niet helemaal uit. Daar komt een prijsdetail bij: 3.8 Flash loopt tot eind december op een introductietarief, daarna verdubbelt Google de prijs voor dit model. Flash Lite valt daarbuiten.
Wat Flash Lite wel en niet kan
Gemini 3.5 Flash Lite is gebouwd voor snelle antwoorden tegen lage kosten. Het leest afbeeldingen en documenten, accepteert tot een miljoen tokens invoer en antwoordt met heel korte wachttijd. Op ChatX is het het snelste model dat gasten zonder account kunnen gebruiken. Voor schermafbeeldingen, vertalingen, samenvattingen en korte uitleg is het ruim voldoende.
De grens ligt bij alles wat meerdere denkstappen vraagt: geneste berekeningen, code met afhankelijkheden, teksten met tegenstrijdige bronnen. Daar geeft het plausibele maar vaak onjuiste antwoorden. Niet omdat het slecht is, maar omdat het daar niet voor gebouwd is.
Ons advies
- Flash Lite als standaard: voor alles wat in één zin te beantwoorden is. Wie als gast begint, heeft daarmee de beste verhouding tussen snelheid en kwaliteit.
- 3.8 Flash op «Laag»: voor programmeerwerk, langere analyses en vakvragen. Het levert voor een fractie van de kosten van Sol resultaten waarvoor kort geleden nog een topmodel nodig was.
- Geen van beide: als maximale nauwkeurigheid telt, dus contracten, cijfers die gecontroleerd worden en stukken waarop een besluit rust. Dan zijn Opus 5.5, Sol of Astra de betere keuze, ook al kosten ze meer.
Een simpele test voor de grens tussen de twee: geeft Flash Lite op dezelfde vraag twee keer een ander antwoord, dan is het een taak voor 3.8 Flash.
