Google heeft een nieuw AI-model gelanceerd, Gemini 3.5 Flash, dat specifiek is ontworpen om de kosten per token te verlagen voor bedrijven. Dit betekent dat je voor dezelfde hoeveelheid werk minder betaalt aan AI-rekenkracht, wat direct voordelig is voor toepassingen zoals klantenservice-chatbots en contentgeneratie.

Wat er aan de hand is

Google heeft Gemini 3.5 Flash aangekondigd, een nieuw model in de Gemini-familie dat zich richt op kostenefficiëntie voor zakelijke gebruikers. Volgens het bedrijf kunnen ondernemingen met dit model minder uitgeven aan tokens dan voorheen. Tokens zijn de basiseenheden die AI-modellen gebruiken om tekst te verwerken; elke prompt en elk antwoord verbruikt een aantal tokens. De precieze prijs per token is niet in de bron vermeld, maar de belofte is een significante verlaging ten opzichte van eerdere modellen. Dit past in een bredere trend waarbij AI-aanbieders concurreren op prijs om de drempel voor adoptie te verlagen. Tegelijkertijd heeft Google ook een nieuwe agent uitgebracht die concurreert met bestaande oplossingen, wat aangeeft dat het bedrijf inzet op zowel prijs als functionaliteit.

Wat dit betekent

Voor Nederlandse MKB’ers die AI inzetten, zoals een klantenservice-chatbot of een tool voor het genereren van productbeschrijvingen, kunnen de lagere tokenkosten direct voelbaar zijn. Stel dat je chatbot gemiddeld 500 tokens per gesprek verbruikt en je hebt 1000 gesprekken per maand, dan verbruik je 500.000 tokens. Bij een prijsdaling van bijvoorbeeld 30% bespaar je maandelijks een aanzienlijk bedrag, afhankelijk van het huidige tarief. Voor contenttools die wekelijks tientallen artikelen of social media posts genereren, kan de besparing nog groter zijn. Dit maakt AI toegankelijker voor bedrijven die voorheen terughoudend waren vanwege de kosten. Het betekent ook dat je bestaande AI-toepassingen kunt uitbreiden zonder dat je budget evenredig stijgt.

Hoe je dit kunt toepassen

Als je een webshop runt met een chatbot voor klantvragen, kun je overwegen om over te stappen naar Gemini 3.5 Flash zodra deze beschikbaar is. Je zou kunnen beginnen met een testperiode van een maand, waarbij je het aantal verbruikte tokens en de kosten vergelijkt met je huidige model. Een mogelijkheid is om de chatbot eerst in te zetten voor een beperkt aantal veelgestelde vragen, zoals bestelstatus of retouren, om de kostenbesparing te meten voordat je hem uitrolt voor alle vragen.

Als je een team aanstuurt dat content produceert, zoals productbeschrijvingen of blogartikelen, kun je de tokenkosten van je huidige AI-tool in kaart brengen. Overweeg om een proefproject te starten met Gemini 3.5 Flash voor het genereren van korte teksten, zoals meta descriptions of social media posts. Je zou de output kunnen vergelijken met je huidige tool op kwaliteit en snelheid, terwijl je de kosten per token bijhoudt. Een optie is om de tool in te zetten voor de eerste concepten, die je team vervolgens bewerkt.

Als je in de zorg werkt en AI gebruikt voor het samenvatten van patiëntendossiers, let dan op de nauwkeurigheid van het model. De lagere kosten betekenen niet automatisch lagere kwaliteit, maar je zou kunnen overwegen om Gemini 3.5 Flash te testen op een kleine steekproef van dossiers. Een mogelijkheid is om de samenvattingen te laten controleren door een medisch professional voordat je het model breder inzet. Dit kan je helpen om te bepalen of de kostenbesparing opweegt tegen eventuele aanpassingen in de output.

Als je een marketingbureau runt en AI inzet voor het genereren van campagneteksten, kun je de tokenkosten per campagne berekenen. Stel dat je maandelijks 50 campagnes draait, elk met gemiddeld 2000 tokens, dan verbruik je 100.000 tokens. Met een prijsverlaging van 30% bespaar je mogelijk honderden euro’s per maand. Overweeg om deze besparing te herinvesteren in meer A/B-testen of personalisatie. Een optie is om het model te gebruiken voor het genereren van meerdere varianten van een tekst, zodat je kunt testen welke het beste presteert.

Bron: AI Business (https://aibusiness.com/generative-ai/google-aims-enterprise-cost-efficiency-with-gemini-3-5-flash)