Google onderzoekt of AI-gegenereerde spam beter te detecteren is door te kijken naar de netwerken waar het vandaan komt, in plaats van elke pagina apart te analyseren. Dit betekent dat je als ondernemer niet alleen op inhoud hoeft te letten om je website te beschermen tegen schadelijke AI-spam, maar ook op de bron van het verkeer.

Wat er aan de hand is

Uit een recente publicatie van Google Research blijkt dat AI-spam mogelijk eenvoudiger te herkennen is door de oorsprong van het verkeer te analyseren. In plaats van elke tekst afzonderlijk te beoordelen, kijken onderzoekers naar patronen in de netwerken die de spam verspreiden. Dit kan helpen om grootschalige AI-spamcampagnes sneller te identificeren, zonder dat je elke pagina handmatig hoeft te controleren. De studie, gepubliceerd door Search Engine Journal, wijst op een verschuiving van content-gebaseerde naar netwerk-gebaseerde detectie.

Wat dit betekent

Voor ondernemers die hun eigen website beheren, betekent dit dat traditionele methoden zoals het scannen op herhaalde zinnen of onnatuurlijke taal mogelijk niet voldoende zijn. AI-spam wordt steeds geavanceerder en kan menselijke tekst nabootsen. Door te focussen op netwerkdetectie, kun je voorkomen dat spam van een verdachte bron je site overspoelt, zonder dat je elke pagina hoeft te doorlopen. Dit is vooral relevant voor webshops, blogs en leadgeneratie-sites die afhankelijk zijn van schone data en goede gebruikerservaring.

Hoe je dit kunt toepassen

Als je een webshop runt en merkt dat er opeens veel spamreacties of nepbestellingen binnenkomen, kun je overwegen om je serverlogs te analyseren. Kijk naar IP-adressen die in korte tijd veel verkeer genereren of die afkomstig zijn van bekende datacenters of VPN-diensten. Je zou een eenvoudige regel kunnen instellen in je firewall of beveiligingsplugin om verkeer van verdachte netwerken te blokkeren.

Als je een blog beheert en last hebt van AI-gegenereerde reacties of gastbijdragen, kun je een tool zoals Cloudflare of Sucuri gebruiken om verkeer te filteren op basis van netwerkherkomst. Een optie is om een lijst aan te maken van IP-reeksen die vaak met spam worden geassocieerd, zoals die van goedkope hostingproviders in het buitenland. Je kunt dan reacties van die netwerken automatisch in de spam-modus zetten.

Als je een leadgeneratie-site hebt en merkt dat formulieren worden overspoeld met nep-inschrijvingen, kun je overwegen om een netwerk-gebaseerde captcha of rate limiting in te stellen. Dit betekent dat je het aantal verzoeken van een enkel IP-adres of netwerk beperkt. Je zou kunnen beginnen met het monitoren van je analytics op pieken van onbekende bronnen, en vervolgens een simpele regel toevoegen in je .htaccess-bestand om die netwerken te blokkeren.

Als je een team aanstuurt dat content plaatst, kun je een proces introduceren waarbij je nieuwe bijdragen controleert op netwerkherkomst. Vraag je redacteuren om een tool zoals WhatIsMyIP te gebruiken om te zien of een gastblogger via een VPN of datacenter werkt. Dit kan een signaal zijn dat de content mogelijk AI-gegenereerd is. Overweeg om een checklist op te stellen met netwerkkenmerken die je voor publicatie checkt.

Als je in de zorg of een andere gereguleerde sector werkt en je site moet voldoen aan strenge kwaliteitseisen, kun je netwerkdetectie inzetten als extra laag. Je zou een plugin zoals Wordfence kunnen configureren om verkeer van bepaalde landen of netwerken te weren, tenzij het expliciet is goedgekeurd. Dit helpt om te voorkomen dat AI-spam je site vervuilt met onjuiste of schadelijke informatie.

Bron: Search Engine Journal