← Terug naar kennisbank

AI Nieuws

Is het legaal om AI te trainen met beschermde boeken?

Is het legaal om AI te trainen met beschermde boeken?

·

Leestijd: 4 min

Je weet waarschijnlijk dat de grote AI-systemen achter chatbots zoals ChatGPT en Claude zijn getraind op enorme verzamelingen teksten: boeken, krantenartikelen, academische papers en alles wat online staat. Veel auteurs hebben zonder het te weten bijgedragen aan die trainingssets. Dat voelt onrechtvaardig, maar de juridische situatie is niet zwart-wit.

Wat speelt er precies?

AI-bedrijven gebruiken miljarden woorden om modellen te trainen. Soms komen die woorden uit legaal verkrijgbare bronnen, soms uit illegale online bibliotheken die gekopieerde boeken aanbieden. Rechters en juristen proberen nu te bepalen wanneer dat gebruik wel of niet mag.

Belangrijke punten die het ingewikkeld maken:

  • Auteurs hebben meestal geen toestemming gegeven voor gebruik van hun werk in AI-training.

  • Sommige bedrijven haalden teksten uit illegale ‘shadow libraries’ (illegale online bibliotheken).

  • Rechters moeten oude auteursrechtregels toepassen op nieuwe technologieën.

Wat zegt de wet en waar draait het om?

De Amerikaanse auteursrechtwet is al lang niet meer aangepast: de huidige regels stammen uit 1976. Rechters gebruiken die regels, en met name het begrip fair use (toegestaan gebruik van beschermd materiaal zonder toestemming), om te beslissen of training van AI onder de wet valt.

Bij de beoordeling van fair use kijken rechters meestal naar een paar factoren:

  • Het doel en de aard van het gebruik (bijvoorbeeld commercieel of educatief).

  • De hoeveelheid en substantie van het gebruikte materiaal.

  • Het effect van het gebruik op de markt voor het oorspronkelijke werk.

Kort samengevat: als het gebruik het originele werk direct schaadt of erop gericht is om er commercieel mee te concurreren, zijn rechters eerder geneigd het onrechtmatig te noemen. Als het gebruik vooral bedoeld is om iets nieuws te leren of te analyseren, weegt dat soms in het voordeel van de AI-maker.

Belangrijke rechtszaken en wat ze betekenen

Sommige uitspraken laten zien hoe ingewikkeld het is om regels te trekken.

  • In de zaak tegen Anthropic veroordeelde rechter William Alsup het bedrijf tot een enorme schadevergoeding van 1,5 miljard dollar aan een groep schrijvers. Tegelijk concludeerde hij dat het trainen van het model op boeken op zich niet per se onrechtmatig was. De straf kwam vooral omdat Anthropic materiaal had gebruikt dat afkomstig was uit illegale online bibliotheken.

  • Volgens juridisch specialisten maakt die uitspraak het voor AI-bedrijven gemakkelijker om te beargumenteren dat trainen vergelijkbaar is met het lezen van een boek: lezen op zich is geen kopiëren. Auteursrecht draait immers vooral om kopiëren en marktimpact.

  • In een andere zaak oordeelde een rechter dat het kopiëren van content door Ross Intelligence niet onder fair use viel omdat het doel was om te concurreren met Thomson Reuters. Dat toont aan dat gebruik dat direct concurreert met de oorspronkelijke markt slechter af is in de rechtszaal.

  • Daarnaast is er de zaak Thaler tegen Perlmutter, waarin een hof oordeelde dat een volledig AI-gegenereerd werk niet in aanmerking komt voor auteursrecht. Dat roept weer nieuwe vragen op: hoe bepaal je of iets 100% door AI is gemaakt, en hoeveel menselijke inbreng nog auteursrecht oplevert?

Wat betekent dit voor schrijvers en voor bedrijven?

Voor schrijvers:

  • Veel schrijvers voelen zich terecht benadeeld als hun werk zonder toestemming wordt gebruikt.

  • Juridische uitspraken kunnen schrijvers deels beschermen, vooral als er bewijs is dat bedrijven illegale bronnen gebruikten.

Voor bedrijven die AI bouwen:

  • Ze moeten opletten welke bronnen ze gebruiken en hoe die verkregen zijn.

  • Rechters kijken naar het doel van het gebruik en naar marktconsequenties.

Algemene consequenties:

  • Er is nog geen eenduidige uitspraak die alles regelt; veel rechtszaken lopen nog.

  • Beslissingen van verschillende rechters kunnen elkaar tegenspreken. Pas later in de juridische strijd zal duidelijk worden welke lijn uiteindelijk gaat winnen.

Conclusie

De simpele vraag "Is het legaal om AI te trainen met beschermde boeken?" kent geen eenvoudig ja of nee. Rechters wegen oude auteursrechtregels af tegen nieuwe technologie. Belangrijke factoren zijn of de teksten uit illegale bronnen komen, of het gebruik concurreert met het originele werk en hoeveel dat gebruik de markt schaadt.

De komende jaren zullen uitspraken van rechtbanken en hoger beroep veel invloed hebben op hoe AI-ontwikkeling en auteursrecht samengaan. Tot die tijd blijft het een veld met veel onzekerheid en worden zowel schrijvers als AI-bedrijven door rechtszaken gevormd.