AI & computing › Generatieve AI & synthetische media

Sony en Warner klagen Anthropic aan om illegaal gedownloade songteksten

· Bijgewerkt 30 augustus 2026, 11:12 · 2 min leestijd

Generatieve AI & synthetische media
Beeld: The Decoder

Muziekuitgevers Sony Music en Warner Music slepen AI-bedrijf Anthropic voor de rechter. Ze zeggen dat het bedrijf tienduizenden auteursrechtelijk beschermde songteksten illegaal downloadde om chatbot Claude te trainen.

Sony Music, Warner Music en andere muziekuitgevers hebben een rechtszaak aangespannen tegen AI-bedrijf Anthropic bij een federale rechtbank in Noord-Californië. Ook topman Dario Amodei en medeoprichter Benjamin Mann worden persoonlijk aangeklaagd. Volgens de aanklacht gaven zij opdracht tot het downloaden van auteursrechtelijk beschermd materiaal via torrent-netwerken. De uitgevers noemen het "een van de grootste en meest flagrante diefstallen van intellectueel eigendom uit de geschiedenis".

De zaak draait om tienduizenden muzikale werken, vooral songteksten, plus bladmuziek en bewerkingen daarvan. Anthropic zou dit materiaal hebben gebruikt om de taalmodellen achter Claude te trainen. De uitgevers eisen tot 150.000 dollar per geschonden werk en tot 25.000 dollar per overtreding voor het verwijderen van copyright-informatie zoals bronvermeldingen.

Torrents als kwetsbare plek

Anthropic verloor eerder al een vergelijkbare zaak. In september 2025 schikte het bedrijf voor 1,5 miljard dollar met auteurs en uitgevers, de grootste auteursrechtschikking ooit in de Verenigde Staten. Niet het trainen op auteursrechtelijk materiaal zelf was daarbij het probleem, maar de manier waarop Anthropic aan die data kwam: via illegale torrent-downloads. Volgens de aanklacht haalde het bedrijf zo minstens zeven miljoen boeken binnen van de piraterijsites LibGen en PiLiMi.

De nieuwe zaak van Sony en Warner richt zich op dezelfde zwakke plek. De uitgevers stellen dat Anthropic ook songteksten scrapete van legale platforms als MusixMatch en LyricFind, in strijd met de gebruiksvoorwaarden van die diensten. Daarnaast zou het bedrijf gebruik hebben gemaakt van omstreden datasets als Books3, The Pile en Common Crawl, en fysieke songboeken en bladmuziek hebben gescand en vernietigd.

Synthetische data als omweg

Een opvallend deel van de aanklacht gaat over hoe Anthropic omging met de torrent-data tijdens het trainen. Het bedrijf ontkent publiekelijk dat het commerciële Claude-modellen rechtstreeks traint op boeken van LibGen en PiLiMi. Volgens de aanklacht hangt die ontkenning af van hoe je "trainen" precies definieert: Anthropic zou een niet-commercieel model, dat wél op die illegale bronnen leerde, hebben gebruikt om synthetische data te genereren waarmee vervolgens een commercieel Claude-model werd getraind. Ook zou zo'n model zijn ingezet om feedback te geven tijdens het trainingsproces van een commercieel model. Wat dit precies inhield, moet blijken tijdens het vervolg van de rechtszaak.

De uitkomst kan verstrekkende gevolgen hebben. In een vergelijkbare zaak oordeelde de rechtbank van München in november 2025 al dat auteursrechtelijk beschermde songteksten ook binnen de parameters van een AI-model als reproducties gelden, en dat een chatbot die teksten reproduceert daarmee onrechtmatig openbaar maakt. De rechter hield daarbij niet de gebruiker die de tekst opvroeg verantwoordelijk, maar het bedrijf achter het model.

Achtergrond & begrippen

Wat betekent dit voor de toekomst? Deze rechtszaak kan bepalen hoe streng AI-bedrijven straks worden aangepakt voor de herkomst van hun trainingsdata, los van de vraag of die data ooit in een eindproduct terechtkwam. Een verlies voor Anthropic zou de kosten van AI-training fors kunnen opdrijven en dwingen tot strengere controle op databronnen.

Large language model
Een AI-model dat getraind is op grote hoeveelheden tekst om taal te begrijpen en te genereren, zoals het model achter chatbot Claude.
Synthetische data
Kunstmatig gegenereerde data, bijvoorbeeld door een AI-model zelf gemaakt, die wordt gebruikt om een ander AI-model te trainen.
Torrent
Een technologie om bestanden te delen tussen gebruikers, vaak gebruikt om illegaal auteursrechtelijk beschermd materiaal te downloaden.

Bronnen

Dit artikel is met behulp van AI geschreven op basis van bovenstaande bronnen en is geen letterlijke vertaling. Zo werkt onze redactie.

Meer over Generatieve AI & synthetische media