Boris.
AI DAGELIJKS

Auteursrecht AI-training: mag dit met jouw content?

24 augustus 2026 | Boris Kusters
Inhoud
Auteursrecht AI-training: mag dit met jouw content?

Je publiceert een blogartikel over jouw vakgebied. Je schrijft productbeschrijvingen die net dat beetje extra overtuigingskracht hebben. Je deelt een klantcase op je website. Zonder dat je het ooit hebt gevraagd, kan die tekst zijn opgenomen in de trainingsdata van een AI-model. Dat is geen theorie, dat gebeurt al jaren op grote schaal.

TechCrunch zette het gisteren scherp neer: de meeste gepubliceerde auteurs hebben, zonder het te weten en zonder toestemming, bijgedragen aan de ontwikkeling van dezelfde AI-tools die nu hun broodwinning bedreigen. Klinkt dat illegaal? Het antwoord is, zoals de titel van het artikel al zegt, ingewikkeld. Er lopen tientallen rechtszaken in de Verenigde Staten, er is een schikking van 1,5 miljard dollar geweest, en ondertussen worden zeldzame boeken vermorzeld zodra ze zijn ingescand voor AI-training.

Voor jou als ondernemer is de vraag niet alleen academisch. Jouw website, blogs en productteksten zijn precies het soort unieke, goed geschreven content waar AI-bedrijven naar op zoek zijn. In dit artikel lees je wat er speelt, hoe de regels in Nederland en de EU verschillen van de VS, en wat je nu al kunt doen.

Wat er deze week speelde rond AI en auteursrecht

Het artikel van TechCrunch van 23 augustus gaat in op de kern van het probleem: AI-bedrijven hebben miljoenen boeken gebruikt om taalmodellen te trainen, vaak zonder de auteurs te betalen of zelfs maar te informeren. In de Verenigde Staten draait de discussie om fair use, een uitzondering in het Amerikaanse auteursrecht die onder bepaalde voorwaarden gebruik van beschermd materiaal toestaat. Rechters buigen zich nu over de vraag of het trainen van een AI-model daaronder valt, en de uitspraken lopen uiteen.

Concreet voorbeeld: Anthropic, het bedrijf achter Claude, schikte vorig jaar voor 1,5 miljard dollar met een groep auteurs nadat bleek dat het bedrijf miljoenen boeken van piraterijsites had gebruikt om zijn modellen te trainen. Niet het trainen zelf was daarbij het probleem, maar de manier waarop de boeken waren verkregen. Dat onderscheid is precies waarom TechCrunch spreekt van ingewikkeld: downloaden van illegale bronnen is een ander verhaal dan trainen op materiaal dat je legaal hebt aangeschaft.

Ondertussen schreef techverslaggever Rutger Otto bij NU.nl deze week over een minstens zo ongemakkelijk detail: zeldzame, fysieke boeken worden na het scannen soms letterlijk vernietigd zodra de tekst is gedigitaliseerd voor AI-training. Het laat zien hoe drastisch de honger naar trainingsdata inmiddels is.

Nederland en de EU: andere spelregels dan de VS

In de EU, en dus ook in Nederland, ligt de basis niet bij fair use maar bij de Europese auteursrechtrichtlijn uit 2019, verwerkt in de Nederlandse Auteurswet. Die regelt een uitzondering voor tekst- en datamining: bedrijven mogen in principe teksten en data analyseren en gebruiken om modellen te trainen, ook als die auteursrechtelijk beschermd zijn.

Het addertje: jij mag je hier als maker tegen verzetten. Die zogeheten TDM-reservering kun je machineleesbaar vastleggen, bijvoorbeeld via je robots.txt-bestand of metadata op je site. Respecteert een AI-bedrijf dat voorbehoud niet, dan overtreedt het wel degelijk de wet, ook al zou hetzelfde gebruik in Amerika misschien als fair use worden gezien.

Daar komt de EU-AI-Act bovenop. Aanbieders van general-purpose AI-modellen, zoals de modellen achter ChatGPT van OpenAI of Claude van Anthropic, moeten sinds vorig jaar een samenvatting publiceren van de data waarmee ze hun model hebben getraind en aantonen dat ze auteursrechtelijke voorbehouden respecteren. Handhaving hiervan staat nog in de kinderschoenen, maar het geeft Nederlandse content-makers voor het eerst een houvast.

Wat betekent dit voor jouw content als ondernemer

Denk niet dat dit alleen een zaak is voor uitgevers en romanschrijvers. Elke blog, productbeschrijving, klantcase of handleiding die je publiceert, is potentieel aantrekkelijk trainingsmateriaal. Nederlandstalige content is zelfs relatief schaars vergeleken met Engelstalige tekst, wat het voor AI-bedrijven extra interessant maakt.

AI-crawlers zoals GPTBot van OpenAI en ClaudeBot van Anthropic bezoeken dagelijks miljoenen websites, ook die van Nederlandse MKB-bedrijven. Tenzij je ze actief blokkeert, nemen ze mee wat ze tegenkomen. Dat raakt niet alleen je auteursrecht, het raakt ook je zichtbaarheid: dezelfde content die een AI-model traint, kan later worden hergebruikt in een AI-antwoord waar bezoekers niet meer doorklikken naar jouw site.

Praktische stappen om je content te beschermen (of juist bewust open te stellen)

Je hebt hier eigenlijk twee keuzes, en allebei zijn legitiem. Optie een: je blokkeert AI-training actief. Zet een TDM-voorbehoud in je robots.txt, verwijs ernaar in je algemene voorwaarden en overweeg specifieke bots zoals GPTBot, ClaudeBot en CCBot te weren.

Optie twee: je laat het bewust toe, omdat zichtbaarheid in AI-antwoorden van ChatGPT of Claude voor jouw type bedrijf juist waardevol is, vergelijkbaar met hoe je nu al investeert in vindbaarheid in Google. Belangrijk is dat je het bewust kiest, in plaats van dat het gewoon gebeurt zonder dat je er ooit bij hebt stilgestaan.

Wil je bewijs verzamelen dat jouw content is gebruikt, dan kun je overwegen tekst subtiel te watermerken of unieke identifiers te verwerken, iets waar ook Anthropic experimenteert met watermerktechnieken voor AI-gegenereerde tekst. Bewaar daarnaast documentatie van je publicatiedata; dat is je bewijslast als je ooit een zaak zou willen beginnen.

Toezichthouders grijpen wel in, ook als auteursrecht nog onduidelijk is

Dat justitie en toezichthouders niet stilzitten, bleek deze week ook uit een heel andere hoek. TikTok schikte met het Amerikaanse ministerie van Justitie voor 400 miljoen dollar wegens schendingen van de online privacy van kinderen, een van de grootste schikkingen ooit op dit gebied. Het laat zien dat platforms wel degelijk worden aangepakt zodra de schade aantoonbaar en het bewijs stevig genoeg is.

Tegelijkertijd blijft de AI-ontwikkeling gewoon doorrazen. Het Britse AI-lab Inherent, opgericht door oud-DeepMind-onderzoekers, presenteerde deze week Faraday, een AI-agent die er volgens het bedrijf beter in slaagt dan modellen van Anthropic en OpenAI om wetenschappelijk onderzoek te repliceren. Terwijl advocaten en rechters nog uitzoeken wat wel en niet mag met trainingsdata, bouwen AI-bedrijven onverminderd door. Wachten op juridische duidelijkheid is dus geen strategie, zelf nu al keuzes maken wel.

Wat dit betekent voor jou

Mijn insteek hierin is nuchter. De juridische strijd over AI en auteursrecht gaat nog jaren duren, met rechtszaken, schikkingen en waarschijnlijk nieuwe wetgeving in zowel de VS als de EU. Als Nederlandse ondernemer kun je daar niet op wachten, en dat hoeft ook niet: de Auteurswet geeft je nu al een instrument, de TDM-reservering, om zelf te bepalen of je content voor AI-training beschikbaar is.

Wat ik klanten in Enschede en daarbuiten adviseer: ga niet in paniek al je content afschermen, maar maak een bewuste keuze per contenttype. Vertrouwelijke rapporten en betaalde content bescherm je, marketingteksten die je juist zichtbaar wilt maken in AI-zoekresultaten laat je misschien liever open. Die keuze is aan jou, zolang je hem maar bewust maakt in plaats van hem aan het toeval over te laten.

Werkt deze AI-ontwikkeling door in jouw bedrijf? SEO voor MKB.

Veelgestelde vragen
Wat is een TDM-voorbehoud en hoe leg ik het vast?

Een TDM-voorbehoud (tekst- en datamining-voorbehoud) is een machineleesbare verklaring waarmee je aangeeft dat je niet wilt dat bedrijven jouw content gebruiken om AI-modellen te trainen. Je legt dit vast via je robots.txt-bestand of via metadata op je website, en je kunt het aanvullen met een bepaling in je algemene voorwaarden.

Mag ik AI-crawlers zoals GPTBot en ClaudeBot blokkeren op mijn website?

Ja, dat mag altijd. Je past je robots.txt aan om specifieke bots de toegang te weigeren. Let op: robots.txt is een verzoek, geen technische blokkade; sommige partijen respecteren het niet automatisch, dus check periodiek of je content toch ergens opduikt.

Is het legaal dat AI-bedrijven trainen op auteursrechtelijk beschermde boeken?

Dat hangt af van waar je zit en hoe het materiaal is verkregen. In de VS wordt dit uitgevochten via de fair-use-doctrine, met wisselende uitspraken. In Nederland en de EU geldt de tekst- en datamining-uitzondering in de Auteurswet, tenzij jij als maker een TDM-voorbehoud hebt vastgelegd.

Wat hield de schikking van Anthropic precies in?

Anthropic, het bedrijf achter Claude, schikte voor 1,5 miljard dollar nadat auteurs aantoonden dat het bedrijf miljoenen boeken van illegale piraterijsites had gedownload om zijn AI-modellen te trainen. Het ging daarbij vooral om de illegale herkomst van de boeken, niet om het trainen zelf.

Valt AI-training onder de EU-AI-Act?

Ja, deels. Aanbieders van general-purpose AI-modellen moeten een samenvatting publiceren van de trainingsdata die ze hebben gebruikt en aantonen dat ze auteursrechtelijke voorbehouden respecteren. De concrete handhaving hiervan is nog volop in ontwikkeling.

Moet ik mijn content juist blokkeren of laten trainen door AI?

Dat is geen kwestie van goed of fout, maar van een bewuste keuze. Blokkeren beschermt je auteursrecht en unieke content; toelaten kan je zichtbaarheid in AI-zoekresultaten vergroten. Kies per contenttype wat het beste bij jouw bedrijf past.

Lees ook
Bronnen
  1. techcrunch.com
  2. nu.nl
  3. nu.nl
  4. techcrunch.com

Liever wekelijks een ruimere samenvatting? Lees ook de wekelijkse AI Quickread.

Gepubliceerd 2026-08-24T07:09:40+02:00