Google heeft een nieuw AI-model gelanceerd, Gemini 3.5 Flash, dat specifiek is ontworpen om de kosten voor bedrijven te verlagen. De tokenprijzen zijn aanzienlijk lager dan bij eerdere modellen, wat directe besparingen oplevert voor elke ondernemer die AI gebruikt voor tekstverwerking, klantenservice of data-analyse. Dit betekent dat je voor hetzelfde budget meer kunt doen, of dat je AI-toepassingen nu rendabel worden waar ze dat eerder niet waren.

Wat er aan de hand is

Google heeft Gemini 3.5 Flash aangekondigd, een nieuw model in de Gemini-familie dat zich richt op kostenefficiëntie voor bedrijven. Volgens het bedrijf zijn de tokenprijzen lager dan bij voorgaande versies, wat betekent dat elke API-aanroep goedkoper wordt. Een token is de basiseenheid die AI-modellen gebruiken om tekst te verwerken; ruwweg staat één token gelijk aan driekwart Engels woord. De prijsdaling is onderdeel van een bredere trend waarin AI-providers concurreren op prijs, nadat eerder al OpenAI en Anthropic hun tarieven verlaagden. Google positioneert Gemini 3.5 Flash als een model dat geschikt is voor productieomgevingen waar volume en kosten de doorslag geven.

Wat dit betekent

Voor Nederlandse MKB’ers betekent deze prijsverlaging concreet dat AI-toepassingen die voorheen te duur waren, nu binnen bereik komen. Stel dat je een chatbot gebruikt voor klantvragen. Bij een ouder model kostte elke verwerking van een klantvraag van gemiddeld 100 tokens ongeveer 0,002 euro. Met Gemini 3.5 Flash kan dat dalen naar 0,0005 euro per vraag. Bij duizend vragen per dag scheelt dat al snel 1,50 euro per dag, ofwel 45 euro per maand. Voor bedrijven die AI gebruiken voor het genereren van productbeschrijvingen, het samenvatten van documenten of het analyseren van feedback, lopen de besparingen snel op. Het gaat niet alleen om directe kostenbesparing: lagere tokenprijzen maken het ook mogelijk om AI in te zetten voor taken waar de marge te klein was, zoals het personaliseren van e-mails of het automatisch beantwoorden van eenvoudige supportvragen.

Hoe je dit kunt toepassen

Als je een webshop runt en productbeschrijvingen laat genereren door AI, dan kun je overwegen om over te stappen op Gemini 3.5 Flash. Stel dat je maandelijks 10.000 productbeschrijvingen laat maken, elk van gemiddeld 200 tokens. Bij een ouder model kostte dat ongeveer 4 euro per maand aan tokens. Met Gemini 3.5 Flash kan dat dalen naar ongeveer 1 euro. Het verschil lijkt klein, maar bij grotere aantallen of bij dagelijks gebruik wordt het snel significant. Je zou kunnen beginnen met een test van honderd beschrijvingen om de kwaliteit te vergelijken met je huidige model.

Als je een team aanstuurt dat veel repetitieve e-mails of rapporten schrijft, dan kun je AI inzetten om concepten te genereren. Een mogelijkheid is om Gemini 3.5 Flash te gebruiken voor het opstellen van standaardantwoorden op klantvragen of het samenvatten van vergaderverslagen. Omdat de tokenprijs lager is, kun je het model vaker en voor meer taken inzetten zonder dat de kosten uit de hand lopen. Overweeg om een proefperiode van een week in te plannen waarin je het model test op een aantal veelvoorkomende taken.

Als je in de zorg of administratie werkt en veel documenten moet samenvatten, dan biedt Gemini 3.5 Flash een manier om dit te automatiseren tegen lagere kosten. Stel dat je dagelijks vijftig lange documenten van elk 5000 tokens moet samenvatten. Bij een duurder model kostte dat al snel 0,50 euro per dag. Met de nieuwe prijzen kan dat dalen naar 0,125 euro. Op jaarbasis bespaar je dan meer dan 90 euro. Een optie is om een pilot te starten met een beperkt aantal documenten om te zien of de samenvattingen voldoen aan jouw kwaliteitseisen.

Als je een marketingbureau runt en AI gebruikt voor het genereren van social media posts of blogartikelen, dan kun je met Gemini 3.5 Flash meer content produceren voor hetzelfde budget. Een mogelijkheid is om het model in te zetten voor het maken van variaties op bestaande teksten, zoals A/B-testversies voor advertenties. Omdat de kosten per token lager zijn, kun je meer varianten laten genereren zonder dat het budget overschreden wordt. Overweeg om een maand lang de output van Gemini 3.5 Flash te vergelijken met je huidige model op snelheid en kwaliteit.

Bron: AIBusiness