AI-tools die gesprekken samenvatten, notuleren of documenten genereren, hallucineren regelmatig. Een recente audit in de Canadese provincie Ontario toont aan dat dit ook gebeurt bij officieel goedgekeurde AI-systemen in de zorg. Voor ondernemers die AI inzetten voor offertes, klantgesprekken of interne notulen, is dit een waarschuwing: vertrouw nooit blind op de output.
Wat er aan de hand is
De auditor-general van Ontario onderzocht AI-scribes die door de provinciale overheid waren aanbevolen voor gebruik door zorgverleners. Deze tools vatten automatisch patiëntgesprekken samen in medische dossiers. Uit de audit bleek dat alle twintig geteste AI-vendors fouten maakten in ten minste één van twee simpele tests. Negen vendors verzonnen informatie die niet in het gesprek voorkwam, twaalf noteerden informatie onjuist en zeventien misten belangrijke details over besproken psychische problemen. De fouten varieerden van het verzinnen van verwijzingen voor bloedtesten tot het verkeerd transcriberen van medicijnnamen. De auditor-generaal waarschuwde dat dit kan leiden tot inadequate of schadelijke behandelplannen.
Wat dit betekent
Deze audit is geen incident in een obscure hoek van de zorg. Het illustreert een structureel probleem van AI-tools: ze kunnen overtuigend klinken terwijl ze feitelijk onjuist zijn. Voor ondernemers betekent dit dat elke AI-toepassing die informatie vastlegt of verwerkt, risico loopt op hallucinaties. Of het nu gaat om een AI-notulist tijdens een klantgesprek, een tool die offertes genereert op basis van een gesprek, of een systeem dat interne rapportages samenvat: de kans op fouten is reëel. Het probleem is extra gevaarlijk omdat de output er professioneel en compleet uitziet, waardoor gebruikers de neiging hebben om het te vertrouwen.
Hoe je dit kunt toepassen
Als je een AI-notulist gebruikt voor klantgesprekken, overweeg dan om een vaste controle in te bouwen. Stuur de samenvatting altijd ter verificatie naar de klant voordat je deze verwerkt in een offerte of contract. Je zou kunnen afspreken dat je binnen 24 uur een reactie verwacht op onjuistheden. Dit voorkomt dat een verzonnen afspraak of een verkeerd genoteerd bedrag de basis wordt van een zakelijke overeenkomst.
Als je AI inzet voor interne rapportages of notulen, is een optie om een tweede, onafhankelijke AI-tool dezelfde input te laten verwerken en de uitkomsten te vergelijken. Dit kost wat extra tijd, maar geeft een snelle indicatie van inconsistenties. Wijken de samenvattingen sterk van elkaar af, dan is handmatige controle noodzakelijk.
Als je een AI-tool gebruikt om offertes te genereren op basis van gespreksopnames, kun je overwegen om een checklist te maken van kritische elementen die altijd handmatig gecontroleerd moeten worden: prijzen, aantallen, leverdata en specifieke productnamen. De audit uit Ontario laat zien dat juist dit soort concrete details vaak fout gaan.
Als je overweegt een AI-tool aan te schaffen voor een kritisch bedrijfsproces, is het verstandig om zelf een simpele stresstest uit te voeren. Neem een standaardgesprek op, laat de tool het verwerken en controleer de output op drie punten: worden er dingen toegevoegd die niet gezegd zijn, worden er dingen weggelaten die wel gezegd zijn, en worden er feiten (namen, data, bedragen) correct overgenomen. Als de tool op een van deze punten faalt, is hij niet geschikt voor productiegebruik zonder menselijke controle.
Bron: Arstechnica (https://arstechnica.com/health/2026/05/your-doctors-ai-notetaker-may-be-making-things-up-ontario-audit-finds/)