Mediahuis, het uitgeefconcern achter onder meer De Telegraaf en De Standaard, is toegetreden tot een internationale alliantie die moet voorkomen dat AI-tools als ChatGPT, Claude en Gemini onbeperkt journalistieke content overnemen. De alliantie heet Standards for Publisher Usage Rights (SPUR) en bestaat verder uit de Financial Times, The Telegraph, The Guardian, BBC en Sky News. SPUR ontwikkelt technische standaarden, licentiekaders en meetinstrumenten waarmee uitgevers controle krijgen over hoe generatieve AI hun werk gebruikt. Dit is een signaal dat ook voor kleinere bedrijven relevant is: jouw productteksten, blogs en handleidingen worden mogelijk gratis geschraapt door AI-modellen.
Wat er aan de hand is
Mediahuis is de eerste Europese uitgever die toetreedt tot SPUR, een coalitie die werkt aan gedeelde technische standaarden voor contentgebruik door AI. De leden willen inzicht krijgen in welke AI’s welke content gebruiken, en op basis daarvan licentiedeals sluiten. Enkele grote uitgevers zoals Axel Springer en News Corp hebben al overeenkomsten met AI-bedrijven. SPUR richt zich op coördinatie en kennisuitwisseling, niet op commerciële onderhandelingen per lid. Gert Ysebaert, ceo van Mediahuis, noemt dit een kantelmoment voor Europese uitgevers om gezamenlijk vorm te geven aan hoe journalistiek wordt gebruikt in AI-ontwikkeling.
Wat dit betekent
Voor ondernemers en professionals betekent dit dat de discussie over contentroof door AI niet alleen speelt bij grote mediaconcerns. Ook jouw bedrijfswebsite, blog of kennisbank is een bron voor AI-trainingsdata. Zolang er geen breed gedragen standaard is, kunnen AI-modellen jouw content gebruiken zonder toestemming of vergoeding. De SPUR-alliantie werkt aan een oplossing, maar die is nog niet beschikbaar voor het MKB. Voorlopig ben je zelf verantwoordelijk voor het beschermen van je online content. Het goede nieuws: er zijn eenvoudige technische maatregelen die je vandaag nog kunt nemen.
Hoe je dit kunt toepassen
Als je een bedrijfsblog beheert met unieke productkennis of vakinhoudelijke artikelen, overweeg om een robots.txt-bestand aan te maken. Dit tekstbestand vertelt geautomatiseerde bezoekers, zoals AI-crawlers, welke delen van je site ze wel en niet mogen bezoeken. Je kunt specifieke mappen of pagina’s uitsluiten voor bekende AI-crawlers zoals GPTBot, Claude-Web of Google-Extended. Een voorbeeldregel in robots.txt is: ‘Disallow: /blog/’ voor GPTBot. Houd er wel rekening mee dat dit een verzoek is, geen afdwingbare regel. Het werkt alleen als de AI-ontwikkelaar zich eraan houdt.
Als je een webshop runt met productbeschrijvingen die je zelf hebt geschreven, kun je overwegen om een llm.txt-bestand toe te voegen aan je server. Dit is een nieuwere standaard, vergelijkbaar met robots.txt, maar specifiek gericht op AI-modellen. In dit bestand kun je aangeven welke content wel en niet gebruikt mag worden voor training. Het is nog geen officiële standaard, maar steeds meer AI-bedrijven ondersteunen het. Je zou kunnen beginnen met een eenvoudig bestand waarin je aangeeft dat je content niet voor training gebruikt mag worden.
Als je een kennisbank of handleidingen online hebt staan die veel waarde hebben voor jouw sector, is het verstandig om te inventariseren welke AI-crawlers je site bezoeken. Je kunt dit in je webserverlogs of via tools zoals Google Search Console zien. Als je merkt dat bepaalde AI’s veel data ophalen, kun je overwegen om die crawlers te blokkeren in je robots.txt. Een optie is om alleen crawlers toe te staan die zich aan de regels houden, zoals die van Google, en andere te weren.
Als je overweegt om licentiedeals te sluiten met AI-bedrijven, is het goed om te weten dat dit momenteel vooral voor grote uitgevers weggelegd is. Voor het MKB is het nog niet realistisch om individueel te onderhandelen. Wel kun je je aansluiten bij brancheorganisaties die mogelijk collectieve afspraken maken. Of je kunt je content via platforms aanbieden die licentievoorwaarden hanteren. De praktische toepassing hangt af van jouw situatie en de schaal van je content.
Bron: Emerce (https://www.emerce.nl/nieuws/mediahuis-alliantie-tegen-contentrovende-ais)