Gemini 3.8 Flash kosten: waarom het model duurder uitpakt
Inhoud
Google heeft deze week alweer een nieuw AI-model uitgebracht: Gemini 3.8 Flash. Opvallend, want de voorganger, Gemini 3.7 Flash, stond nog geen twee maanden op de teller. Volgens Google werkt het nieuwe model "harder": het zet meer redeneerstappen in bij lastige taken en roept losse tools herhaaldelijk aan om tot een antwoord te komen.
Dat klinkt als vooruitgang, en de instapprijs blijft gelijk aan die van 3.7 Flash: 0,75 dollar per miljoen invoertokens en 3,75 dollar per miljoen uitvoertokens. Toch geeft Google zelf al aan dat de rekening voor gebruikers hoger kan uitvallen. Hoe dat kan, en wat je daarmee moet als eigenaar van een Nederlands MKB-bedrijf, lees je hieronder.
Elke dag AI begrijpen, zonder de hype?
Ontvang de gratis MKB AI Quickstart-gids en mijn nuchtere AI-updates. Uitschrijven met 1 klik.
Wat is er precies nieuw aan Gemini 3.8 Flash
Gemini 3.8 Flash is het snelle en goedkope model in de Gemini-familie van Google, bedoeld voor taken die niet per se de zwaarste rekenkracht nodig hebben: klantenservice-teksten, samenvattingen, eenvoudige data-analyse. Het verschil met de vorige versie zit in hoe het model tot een antwoord komt. Waar 3.7 Flash bij een ingewikkelde vraag vaak in één keer doorstoomde naar een antwoord, denkt 3.8 Flash langer na en checkt het zichzelf vaker voordat het klaar is.
Diezelfde aanpak geldt voor tools. Moet het model een zoekopdracht doen, een rekensom maken of gegevens uit een ander systeem ophalen, dan doet 3.8 Flash dat nu iteratief: het probeert iets, bekijkt het resultaat en probeert het zo nodig opnieuw met een aangepaste aanpak. Dat moet leiden tot betere antwoorden bij complexe taken.
Waarom gelijke prijzen toch een hogere factuur geven
Hier zit de kern van het bericht van Google. De prijs per token blijft identiek aan 3.7 Flash, maar het aantal tokens dat nodig is om een taak af te ronden, kan flink stijgen. Een taak die eerst in 500 tokens werd afgehandeld, kan met 3.8 Flash zomaar 1500 tokens kosten omdat het model meerdere keren nadenkt en tools aanroept voor het een antwoord teruggeeft.
Voor een MKB-bedrijf dat een AI-tool of agent op basis van Gemini heeft gebouwd, betekent dit dat de maandfactuur kan stijgen zonder dat er iets is veranderd aan hoe vaak je het model gebruikt. Je stelt dezelfde vragen, maar het model doet er meer werk voor, en dat werk kost geld.
Gemini 3.8 Flash tegenover andere opties voor je MKB
Google is deze week niet de enige partij die aan de knoppen draait. Anthropic bracht een dag eerder Claude Fable 5.1 uit, met juist de tegenovergestelde beweging: lagere kosten en minder overbodige weigeringen door de veiligheidsfilters van het model.
Google Gemini 3.8 Flash: sterk in snelheid en het zelfstandig combineren van tools, met een lage prijs per token. Het risico zit in onvoorspelbaar verbruik: hoeveel een taak kost, hangt af van hoeveel stappen het model zelf nodig acht.
Anthropic Claude Fable 5.1: recent goedkoper geworden en minder streng, wat in de praktijk betekent dat je minder vaak een taak handmatig hoeft over te nemen omdat het model een verzoek afwijst. Meer hierover lees je in ons stuk over Claude Fable 5.1 en de prijsdaling voor MKB.
Geen van beide modellen is universeel beter. Het hangt af van je taak, je datastroom en hoeveel controle je wilt houden over de kosten.
Wat je hiermee doet in de praktijk
Voor de Nederlandse MKB-realiteit is het advies simpel: reken in afgeronde taken, niet in tokens of maandelijkse abonnementsprijzen. Vraag jezelf bij elke AI-tool af wat een taak volledig afgerond kost, inclusief de tussenstappen die je niet ziet.
Bouw je zelf agents of koppelingen op basis van een model als Gemini, zorg dan dat je niet vastzit aan één leverancier. Wissel je makkelijk tussen modellen, dan kun je meebewegen als de ene partij duurder wordt en de andere goedkoper. Wij schreven eerder over hoe je vendor lock-in voorkomt met een AI-gateway.
Let ook op de AVG-kant van meer iteratieve tool-aanroepen: hoe vaker een model tussentijds gegevens doorstuurt naar andere diensten om een taak af te ronden, hoe belangrijker het is dat je weet welke verwerkers daarbij betrokken zijn en of daar een verwerkersovereenkomst voor ligt.
Extra: Google Pics laat zien waar het heen gaat
In dezelfde week lanceerde Google ook Pics, een nieuwe ontwerptool binnen Workspace waarin je beelden niet zelf ontwerpt maar promt. Het is gebouwd op Gemini en het Nano Banana-beeldmodel, en moet het straks opnemen tegen Canva en Adobe voor professioneel ogende bedrijfsbeelden.
Het past in hetzelfde patroon: Google verwerkt steeds meer taken in de modellen zelf, van tekst tot beeld tot tussenstappen die vroeger een aparte tool of medewerker nodig hadden. Voor je marketing betekent dat kansen, maar reken ook hier eerst uit wat een gegenereerde afbeelding je daadwerkelijk kost voor je al je ontwerpwerk verplaatst.
Wat dit betekent voor jou
Mijn insteek: laat je niet gek maken door de snelheid waarmee nieuwe modellen verschijnen. Google bracht in twee maanden tijd twee versies van Flash uit, en dat tempo gaat voorlopig niet omlaag. Wat wel telt voor jouw bedrijf is niet welk model het nieuwst is, maar wat een taak je structureel kost en of dat opweegt tegen de tijd die het je bespaart.
Vanuit Marketing Maatwerk in Enschede help ik MKB-bedrijven precies dat uit te zoeken: welke AI-tool past bij welke taak, en tegen welke kosten. Wil je daar een keer kort over sparren, boek dan een korte sparring.
Werkt deze AI-ontwikkeling door in jouw bedrijf? boek een korte sparring.
Wat is Gemini 3.8 Flash?
Gemini 3.8 Flash is het nieuwste snelle AI-model van Google. Het zet meer redeneerstappen in en roept tools iteratief aan om complexere taken beter af te handelen dan zijn voorganger Gemini 3.7 Flash.
Is Gemini 3.8 Flash duurder dan Gemini 3.7 Flash?
De prijs per token is gelijk gebleven: 0,75 dollar per miljoen invoertokens en 3,75 dollar per miljoen uitvoertokens. Doordat het model meer stappen zet, kan het totale tokenverbruik per taak wel hoger uitvallen, waardoor je factuur alsnog stijgt.
Hoe weet ik hoeveel een AI-model mij per maand kost?
Test een representatieve taak in het API-dashboard van je leverancier en kijk naar het werkelijke tokenverbruik, niet alleen naar de prijs per token op de website. Zo reken je de kosten om naar wat een taak jou in de praktijk kost.
Wat is het verschil tussen Gemini 3.8 Flash en Claude Fable 5.1?
Gemini 3.8 Flash van Google zet in op meer redeneerstappen per taak, terwijl Claude Fable 5.1 van Anthropic juist goedkoper is geworden en minder snel taken weigert. Welke van de twee voordeliger is, hangt af van je specifieke taak.
Moet mijn MKB overstappen op het nieuwste AI-model?
Niet automatisch. Test eerst of het nieuwe model daadwerkelijk beter presteert op jouw taken en wat dat kost, voordat je een bestaande koppeling omzet.
Wat is Google Pics?
Google Pics is een nieuwe AI-ontwerptool binnen Workspace waarmee je beelden promt in plaats van zelf ontwerpt. Het is gebouwd op Gemini en het Nano Banana-beeldmodel en gepositioneerd tegenover Canva en Adobe.
Grip op AI, zonder de hype
Ontvang de gratis MKB AI Quickstart-gids plus mijn nuchtere AI-updates. Uitschrijven kan altijd met 1 klik.