Mediahuis treedt toe tot een internationale alliantie die uitgevers meer controle moet geven over hoe AI-modellen hun content gebruiken. Voor kleine uitgevers en ondernemers die bloggen betekent dit dat er eindelijk een gezamenlijke vuist wordt gemaakt tegen het ongevraagd schrapen van journalistiek werk. Maar je hoeft niet te wachten op de grote jongens: je kunt vandaag al stappen zetten om je eigen content te beschermen.
Wat er aan de hand is
Het Europese uitgeefbedrijf Mediahuis, uitgever van onder meer De Standaard en De Telegraaf, is toegetreden tot de SPUR-coalitie (Standards for Publisher Usage Rights). Deze internationale groep, opgericht door de Financial Times, The Guardian, BBC, Sky News en The Telegraph, werkt aan technische standaarden, licentiekaders en meetinstrumenten. Het doel is om inzichtelijk te maken welke AI-modellen zoals ChatGPT, Claude, Gemini en Grok content van uitgevers gebruiken, en om daar vervolgens afspraken over te maken. Volgens Gert Ysebaert, ceo van Mediahuis, pakt de coalitie een van de belangrijkste uitdagingen voor de journalistieke sector aan: hoe zorg je dat kwaliteitsjournalistiek op een verantwoorde manier wordt ingezet bij de ontwikkeling van AI. De alliantie staat open voor nieuwe deelnemers, ongeacht uit welk land ze komen.
Wat dit betekent
Voor kleine uitgevers en ondernemers die regelmatig publiceren, is dit een signaal dat de machtsverhoudingen langzaam verschuiven. Waar AI-bedrijven tot nu toe grotendeels ongestraft content konden schrapen, ontstaat nu een gecoördineerde tegenbeweging. De SPUR-alliantie ontwikkelt meetinstrumenten die moeten laten zien op welke schaal welke AI’s content gebruiken. Op basis van die data kunnen uitgevers vervolgens onderhandelen over licenties en vergoedingen. Voor een kleine speler is het echter nog lastig om individueel met een OpenAI of Google aan tafel te zitten. De kracht van SPUR zit in de bundeling: hoe meer partijen meedoen, hoe sterker de onderhandelingspositie. De commerciële invulling blijft overigens aan de afzonderlijke leden, dus er komt geen centraal licentiemodel.
Hoe je dit kunt toepassen
Als je een blog of nieuwswebsite runt met unieke content, overweeg om direct je robots.txt en llm.txt-bestand te controleren en aan te vullen. In het artikel wordt genoemd dat er al particuliere initiatieven zijn die via extra tekst in deze bestanden aangeven wat AI’s wel en niet mogen doen. Een robots.txt vertelt zoekmachines en andere geautomatiseerde bezoekers welke pagina’s ze wel of niet mogen indexeren. Een llm.txt is een specifiekere variant voor AI-modellen. Je kunt deze bestanden zelf aanpassen via de root van je server. Het is geen garantie dat AI-bedrijven zich eraan houden, maar het is een eerste stap die je vandaag nog kunt zetten.
Als je een klein uitgeefbedrijf hebt met meerdere titels of themasites, zou je kunnen overwegen om je aan te sluiten bij een brancheorganisatie die de ontwikkelingen rond SPUR volgt. De alliantie staat open voor nieuwe deelnemers, maar voor een kleine partij is het waarschijnlijk effectiever om via een koepel mee te doen dan individueel. Informeer bij je uitgeversvereniging of zij op de hoogte zijn van de SPUR-standaarden en of er collectieve stappen worden overwogen. Zo profiteer je van de kennis en coördinatie die de coalitie biedt, zonder dat je zelf een groot juridisch of technisch team nodig hebt.
Als je overweegt om licentiedeals te sluiten met AI-bedrijven, is het verstandig om eerst inzicht te krijgen in hoe jouw content wordt gebruikt. De SPUR-alliantie werkt aan betrouwbare meetinstrumenten, maar die zijn er nog niet voor iedereen. In de tussentijd kun je zelf een eenvoudige scan doen: gebruik tools zoals Screaming Frog of een eigen loganalyse om te zien welke bots je site bezoeken. Let op user agents van bekende AI-bedrijven zoals GPTBot, Claude-Web of Google-Extended. Als je ziet dat er veel verkeer van die bots komt, kun je overwegen om contact op te nemen met de betreffende AI-aanbieder en te vragen naar hun contentgebruikbeleid. Het is een laagdrempelige manier om te ontdekken of jouw content al wordt gebruikt.
Bron: Emerce