Google’s nieuwste onderzoeksmethode kan AI-gegenereerde spam opsporen door niet naar losse pagina’s te kijken, maar naar de netwerken waar die pagina’s vandaan komen. Dit betekent dat websites die op grote schaal AI-content publiceren, sneller en systematischer worden aangepakt. Voor ondernemers die zelf AI inzetten voor content, is het belangrijk om te begrijpen hoe deze detectie werkt en wat je kunt doen om je site te beschermen.
Wat er aan de hand is
Google Research heeft een paper gepubliceerd waarin een nieuwe aanpak voor het detecteren van AI-spam wordt beschreven. In plaats van elke pagina afzonderlijk te analyseren op inhoudelijke kenmerken, richt de methode zich op de netwerken van waaruit de content wordt verspreid. Het idee is dat AI-spam vaak afkomstig is van een beperkt aantal bronnetwerken, zoals gedeelde hostingomgevingen, IP-adressen of contentmanagementsystemen die op grote schaal worden gebruikt voor geautomatiseerde publicatie. Door deze netwerken in kaart te brengen, kan Google in één keer grote hoeveelheden spam identificeren, zonder dat elke pagina handmatig hoeft te worden beoordeeld. Volgens Search Engine Journal suggereert het onderzoek dat deze aanpak efficiënter is dan traditionele contentanalyse.
Wat dit betekent
Voor MKB’ers die AI gebruiken om content te genereren, verandert er iets fundamenteels. Tot nu toe lag de focus bij spamdetectie vooral op de kwaliteit van de tekst: herhaalde zinnen, onnatuurlijke woordkeuzes of gebrek aan diepgang. Met deze netwerkmethode wordt het irrelevant of je AI-content er ‘goed’ uitziet. Als jouw site deel uitmaakt van een netwerk dat door Google als spamverdacht wordt gemarkeerd, loop je risico op een penalty, ongeacht de kwaliteit van de individuele pagina’s. Dit treft vooral bedrijven die bulkcontent laten genereren via dezelfde hosting, hetzelfde CMS of dezelfde AI-tool als andere spamwebsites. Ook voor concurrentieanalyse wordt deze methode interessant: je kunt mogelijk zien of een concurrent gebruikmaakt van AI-spamnetwerken, zonder dat je elke pagina hoeft te analyseren.
Hoe je dit kunt toepassen
Als je AI gebruikt voor contentproductie, is het belangrijk om te controleren of jouw hostingomgeving of AI-tool niet op een gedeeld netwerk zit dat door Google als spamverdacht wordt gezien. Je zou kunnen nagaan of je hostingprovider andere sites host die bekendstaan om spam. Overweeg om een dedicated server of een gerenommeerde cloudprovider te gebruiken, zodat je IP-adres niet wordt geassocieerd met massale AI-publicatie. Ook kun je je AI-tool testen door een paar voorbeeldpagina’s te laten beoordelen via een tool als Copyscape of Originality.ai, maar wees je ervan bewust dat die tools vooral op tekstniveau controleren, niet op netwerkniveau.
Als je een webshop runt en AI inzet voor productbeschrijvingen, loop je een vergelijkbaar risico. Veel webshops gebruiken dezelfde AI-plugin of dezelfde hosting voor duizenden productpagina’s. Een mogelijkheid is om je productbeschrijvingen te laten variëren in lengte en stijl, zodat ze niet allemaal uit dezelfde bron lijken te komen. Overweeg om per productcategorie een andere AI-sjabloon te gebruiken, of laat een redacteur steekproefsgewijs aanpassingen doen. Dit verkleint de kans dat Google je hele productaanbod als één spamnetwerk classificeert.
Als je een team aanstuurt dat content publiceert, kun je een interne audit doen van je publicatie-infrastructuur. Vraag je hostingprovider of zij een overzicht kunnen geven van andere sites op hetzelfde IP-adres. Als die sites veel AI-content bevatten of bekendstaan als spam, is het verstandig om te migreren naar een andere server. Ook kun je overwegen om een aparte domeinnaam of subdomein te gebruiken voor AI-gegenereerde content, zodat je kernsite niet wordt meegesleurd in een eventuele penalty.
Als je concurrentieanalyse doet, kun je deze netwerkdetectie zelf toepassen door te kijken naar de hosting en IP-adressen van concurrenten. Tools zoals WhatIsMyIPAddress of MXToolbox kunnen je laten zien of meerdere concurrenten op dezelfde server draaien. Als dat het geval is, en je vermoedt dat zij AI-content gebruiken, dan is de kans groot dat Google dat netwerk op termijn zal aanpakken. Dit geeft je een strategisch voordeel: je kunt anticiperen op een daling van hun rankings en zelf investeren in originele, handgemaakte content.
Bron: Search Engine Journal (https://www.searchenginejournal.com/google-generated-ai-detected/579987/)