En gruppe amerikanske aviser anført af New York Times har taget et markant juridisk skridt i deres langvarige opgør med OpenAI. I en begæring indgivet torsdag til en føderal domstol i Manhattan kræver aviserne, at OpenAI idømmes sanktioner for angiveligt at have løjet for retten om sin evne til at søge i sine egne systemer for beviser på ophavsretskrænkelser. Det rapporterer Reuters.

Ifølge avisernes advokater hævdede OpenAI i mere end to år, at det teknisk set ikke var muligt at søge i selskabets store sprogmodellers træningsdata og output-logs efter ophavsretsbeskyttet indhold fra de sagsøgende medier. Men en OpenAI-ansat vidnede siden hen under edsfæstet forklaring, at selskabet faktisk havde foretaget netop sådanne søgninger, allerede inden den første avis indleverede sin stævning.

Milliarder af samtaler slettet eller gjort utilgængelige

Aviserne hævder desuden, at OpenAI slettede milliarder af relevante ChatGPT-samtaler eller gjorde dem utilgængelige for søgning, og dermed fjernede potentielle beviser for, i hvilken grad ophavsretsbeskyttet journalistik har været brugt til at træne AI-systemet. De sagsøgende medier beder nu retten om at fastslå, at de slettede logs ville have vist, at OpenAI misbrugte deres indhold uden tilladelse.

“This motion asks the court to punish OpenAI for hiding and destroying evidence showing how ChatGPT was trained on stolen journalism,” sagde advokat Steven Lieberman, der repræsenterer New York Daily News og syv søsteraviser.

OpenAI afviser anklagerne på det skarpeste. Selskabets talsmand Drew Pusateri kaldte dem ifølge Reuters “grundløst falske” og argumenterede for, at avisernes sag er svækket, og at kravet om adgang til ChatGPT-logs reelt er et forsøg på at krænke privatlivet for brugere, der intet har med sagen at gøre. OpenAI har tidligere forklaret sine begrænsninger med hensynet til brugernes privatliv.

En sag med globale konsekvenser, også for dansk presse

New York Times anlagde den oprindelige sag mod OpenAI og Microsoft i slutningen af 2023 med påstanden om, at selskaberne uden tilladelse brugte millioner af avisens artikler til at træne den sprogmodel, der driver ChatGPT. Siden er flere medier tiltrådt søgsmålet, heriblandt Chicago Tribune og det digitale mediehus Ziff Davis. New York Times har ifølge regnskabsoplysninger brugt over 28 millioner dollars på retssager mod AI-selskaber.

Sagen følges tæt langt uden for USA’s grænser. I Danmark arbejder organisationer som Copydan, Journalistforbundet og RettighedsAlliancen med de samme grundlæggende spørgsmål: Hvad sker der med ophavsretsbeskyttet journalistik, når den bruges til at fodre kommercielle AI-systemer? EU’s AI-forordning stiller krav om transparens fra AI-udbydere, men RettighedsAlliancen har påpeget, at reglerne måske ikke i praksis er tilstrækkelige til at beskytte rettighedshaverne. Sagen i Manhattan kan, alt efter udfald, komme til at definere, hvad der er tilladt, ikke bare i USA, men som reference for regulatorer og domstole i hele verden.

“Instead of just producing that evidence at the start of the case and focusing on the merits of its fair use defense, OpenAI chose obstruction,” skrev avisernes advokater i begæringen til retten.

OpenAI og Microsoft har konsekvent argumenteret for, at træning af AI-modeller på offentligt tilgængeligt materiale er beskyttet af den amerikanske “fair use”-doktrin, der under visse betingelser tillader brug af ophavsretsbeskyttet materiale uden tilladelse. Avisernes sanktionsbegæring forsøger imidlertid at flytte sagens tyngdepunkt fra det juridiske spørgsmål om fair use til det processuelle spørgsmål om, hvorvidt OpenAI har handlet i god tro over for retten, et spørgsmål der er afgørende uanset sagens endelige udfald.

Denne artikel er gratis at læse. Det bliver den ved med at være — ingen betalingsmur, ingen konto, ingen sporing.