Het antwoord: AI kan stemmen reconstrueren uit visuele representaties van audio, zoals spectrogrammen. Dit betekent dat bedrijven die klantgesprekken opnemen of interne audio vastleggen, een nieuw risico lopen: gevoelige data kan worden gemanipuleerd of misbruikt zonder dat er ooit een geluidsbestand is gelekt.

Wat er aan de hand is

TechCrunch meldt dat mensen AI hebben gebruikt om cockpitopnames te reconstrueren op basis van een spectrogrambeeld. Een spectrogram is een visuele weergave van geluid, vaak gebruikt in onderzoek naar vliegrampen. Door AI toe te passen op dit beeld, konden gebruikers de stemmen van overleden piloten nabootsen. De Amerikaanse transportveiligheidsraad NTSB moest tijdelijk de toegang tot haar dossiersysteem blokkeren om verdere manipulatie te voorkomen.

Dit is geen theoretisch scenario. Het laat zien dat AI niet alleen tekst of afbeeldingen kan vervalsen, maar ook audio. En dat met minimale input: een screenshot van een geluidsgolf is genoeg om een stem te reconstrueren.

Wat dit betekent

Voor ondernemers en professionals die klantgesprekken opnemen, interne vergaderingen vastleggen of voice-assistenten gebruiken, verandert het risicoprofiel. Het is niet langer voldoende om alleen geluidsbestanden te beveiligen. Ook visuele representaties van audio, zoals dashboards die gespreksfrequenties tonen, kunnen een datalek veroorzaken.

Dit raakt met name sectoren waar vertrouwelijke audio een rol speelt: klantenservice, juridische dienstverlening, medische consulten, en interne bedrijfscommunicatie. Als een derde partij toegang krijgt tot een screenshot van een gespreksanalyse, kan AI die data gebruiken om stemmen te reconstrueren of te manipuleren.

Hoe je dit kunt toepassen

Als je klantgesprekken opneemt voor kwaliteitscontrole, overweeg dan om visuele weergaven van audio, zoals spectrogrammen of gespreksgrafieken, niet zichtbaar te maken in gedeelde dashboards. Een screenshot van zo’n dashboard kan door AI worden gebruikt om de oorspronkelijke audio te reconstrueren. Beperk de toegang tot deze visuele data tot medewerkers die het echt nodig hebben.

Als je interne vergaderingen opneemt of transcribeert, is het verstandig om na te denken over hoe je deze data deelt. Een transcript is veiliger dan een opname, maar ook een transcript kan worden gebruikt om stemprofielen te maken. Overweeg om opnames automatisch te laten verwijderen na transcriptie, en bewaar alleen de tekstuele versie.

Als je een voice-assistent of spraakgestuurd systeem gebruikt in je bedrijf, controleer dan of de software visuele representaties van audio genereert. Sommige systemen tonen realtime spectrogrammen of frequentiegrafieken. Als deze beelden worden gedeeld of opgeslagen in een cloudomgeving, kunnen ze een veiligheidsrisico vormen. Vraag je leverancier of deze functie kan worden uitgeschakeld.

Als je werkt met gevoelige klantdata, zoals in de zorg of juridische sector, is het aan te raden om je beveiligingsbeleid te herzien. Waar je eerder dacht aan encryptie van geluidsbestanden, moet je nu ook visuele data meenemen in je risicoanalyse. Een screenshot van een gespreksanalyse is net zo gevoelig als de opname zelf.

De praktische toepassing hangt af van jouw situatie, maar de kern is duidelijk: elk visueel spoor van audio is een potentieel datalek. Behandel spectrogrammen en gespreksgrafieken met dezelfde zorg als de originele opnames.

Bron: TechCrunch (https://techcrunch.com/2026/05/22/ai-is-being-used-to-resurrect-the-voices-of-dead-pilots/)