Het antwoord op de vraag welk AI-model het beste past bij jouw dagelijkse bedrijfstaken hangt af van wat je precies wilt automatiseren. Zapier heeft een eigen test ontwikkeld, AutomationBench, die AI-modellen beoordeelt op hoe goed ze meerstaps-workflows uitvoeren, niet alleen losse opdrachten. Op basis van die test kun je een model kiezen dat past bij facturatie, klantenservice of planning, zonder dat je technische kennis nodig hebt.

Wat er aan de hand is

Zapier, het platform waarmee je apps aan elkaar koppelt zonder te programmeren, heeft een overzicht gepubliceerd van alle AI-modellen die je via hun dienst kunt inzetten. Het gaat om modellen van aanbieders als OpenAI, Google, Anthropic en andere partijen. Wat nieuw is: Zapier test elk model met AutomationBench, een eigen benchmark die meet hoe goed een model complexe, praktische taken uitvoert. Denk aan het verwerken van een klantvraag, het bijwerken van een factuur of het plannen van een afspraak. Dit is anders dan de gebruikelijke tests die alleen kijken naar hoe goed een model een vraag beantwoordt. Het nieuws is relevant omdat het MKB’ers een houvast geeft in de overweldigende stroom van nieuwe AI-modellen.

Wat dit betekent

Voor ondernemers en professionals betekent dit dat je niet langer blind hoeft te kiezen tussen tientallen AI-modellen. De AutomationBench-resultaten geven een indicatie van welk model geschikt is voor specifieke werkstromen. Een model dat goed scoort op creatieve teksten, kan bijvoorbeeld minder geschikt zijn voor gestructureerde taken zoals het verwerken van ordergegevens. Dit bespaart tijd en geld: je hoeft niet te experimenteren met modellen die niet passen bij jouw dagelijkse processen. Vooral voor kleine bedrijven zonder IT-afdeling is dit een praktisch hulpmiddel om AI in te zetten zonder technische drempels.

Hoe je dit kunt toepassen

Als je facturatie en boekhouding automatiseert, kun je overwegen om een model te kiezen dat goed presteert op gestructureerde taken. Uit de AutomationBench-test blijkt dat sommige modellen beter zijn in het verwerken van data in vaste formaten, zoals het uitlezen van facturen of het bijwerken van grootboekrekeningen. Een optie is om een model te selecteren dat specifiek getest is op meerstaps-workflows, zodat je zeker weet dat het een factuur kan controleren, goedkeuren en doorsturen zonder tussenkomst.

Als je klantenservice wilt ondersteunen, is het verstandig om te kijken naar modellen die goed scoren op het begrijpen van context en het uitvoeren van meerdere stappen. Stel dat een klant een retour aanvraagt: het model moet de bestelling opzoeken, de retourvoorwaarden controleren en een label aanmaken. Je zou kunnen kiezen voor een model dat in AutomationBench hoge scores haalt op taken met meerdere opeenvolgende acties, zodat de klantenservice soepeler verloopt.

Als je planning en afspraken beheert, kun je een model inzetten dat goed is in het verwerken van natuurlijke taal en het koppelen van agenda’s. Een mogelijkheid is om een model te gebruiken dat uit e-mails automatisch afspraken herkent, de beschikbaarheid checkt in je agenda en een bevestiging stuurt. De AutomationBench-resultaten helpen je te bepalen welk model dit betrouwbaar kan doen, zonder dat je handmatig hoeft te controleren of de planning klopt.

Als je content of marketingteksten genereert, let dan op modellen die specifiek getest zijn op creatieve taken. Sommige modellen zijn beter in het schrijven van overtuigende teksten, terwijl anderen meer geschikt zijn voor feitelijke rapportages. Je zou kunnen experimenteren met een model dat in de test goed scoort op het omzetten van ruwe data naar leesbare tekst, zoals het samenvatten van klantfeedback of het schrijven van productbeschrijvingen.

Bron: Zapier (https://zapier.com/blog/ai-models-on-zapier)