Encyclopedia Britannica en Merriam-Webster hebben een rechtszaak aangespannen tegen OpenAI, waarin zij beweren dat hun auteursrechtelijk beschermde inhoud zonder toestemming is gebruikt om de AI-modellen van OpenAI te trainen. De zaak, die op vrijdag werd ingediend, beschuldigt OpenAI ervan om inhoud van beide uitgeverijen te genereren die “substantieel identiek” is aan hun eigen teksten.
Volgens de aanklacht heeft OpenAI delen van de inhoud van Encyclopedia Britannica gekopieerd zonder toestemming. De uitgeverij stelt dat het GPT-4 model, ontwikkeld door OpenAI, grote delen van hun materiaal ‘gememoriseerd’ heeft en dit op aanvraag bijna woordelijk kan reproduceren. Deze gereproduceerde inhoud zou volgens Britannica ongeautoriseerde kopieën zijn die zijn gebruikt tijdens het trainen van de AI-modellen van OpenAI.
De rechtszaak presenteert voorbeelden waarin de antwoorden van de AI-modellen van OpenAI naast de teksten van Britannica worden geplaatst, waarbij hele passages bijna identiek lijken te zijn. Britannica beweert dat OpenAI door deze praktijken hun webverkeer ‘kannibaliseert’ door antwoorden te genereren die hun inhoud vervangen of ermee concurreren, in plaats van gebruikers door te sturen naar hun website zoals een traditionele zoekmachine zou doen.
Deze rechtszaak is de nieuwste in een reeks juridische stappen die uitgevers de afgelopen jaren hebben ondernomen tegen AI-bedrijven. Eerder heeft ook de New York Times vergelijkbare claims ingediend tegen OpenAI, waarin ze het bedrijf beschuldigen van het kopiëren van grote hoeveelheden van hun auteursrechtelijk beschermde inhoud. In een andere zaak schikte het AI-bedrijf Anthropic een groepsrechtszaak voor het gebruiken van auteursrechtelijk beschermde boeken in de training van hun AI-modellen, wat resulteerde in een schikking van 1,5 miljard dollar aan de auteurs van deze boeken.
Deze rechtszaken tonen de groeiende spanning tussen traditionele uitgeverijen en AI-bedrijven aan, waarbij de vraag centraal staat hoe intellectuele eigendommen moeten worden beschermd in een tijdperk waarin kunstmatige intelligentie steeds geavanceerder wordt. Het debat gaat niet alleen over de juridische aspecten, maar raakt ook aan ethische kwesties rondom het gebruik van auteursrechtelijk beschermde inhoud voor technologische vooruitgang.
Het is nog onduidelijk hoe de rechtbank zal oordelen in deze specifieke zaak, maar het resultaat kan verstrekkende gevolgen hebben voor de manier waarop AI-modellen in de toekomst worden getraind. De uitkomst kan ook invloed hebben op de manier waarop AI-bedrijven omgaan met auteursrechtelijk beschermde inhoud en hoe zij hun modellen ontwikkelen zonder inbreuk te maken op intellectuele eigendomsrechten.
OpenAI heeft nog niet publiekelijk gereageerd op de rechtszaak van Britannica en Merriam-Webster. Hoewel de exacte juridische strategie van OpenAI onbekend is, kan verwacht worden dat het bedrijf zijn gebruik van dergelijke inhoud zal verdedigen als noodzakelijk voor de ontwikkeling van geavanceerde AI-technologieën.
Deze zaak benadrukt de noodzaak voor een duidelijke regelgeving en richtlijnen met betrekking tot het gebruik van auteursrechtelijk beschermd materiaal in AI-training. Terwijl de technologie zich blijft ontwikkelen, zal de balans tussen innovatie en auteursrechten een cruciaal onderwerp van discussie blijven in de juridische en technologische sectoren.