kunstig intelligens
Innrømmer at KI-teknologien bygger på det «største tyveriet noensinne»
Microsoft og Open AI innrømmer at KI er en trussel mot publisister.
Kunstig intelligens er en kontroversiell teknologi på flere måter, og blant innsigelsene mange har, er den enorme mengden åndsverk som går med til treningen av modellene.
På tampen av 2023 gikk flere medier, med The New York Times i spissen, til søksmål mot Microsoft og Open AI for alvorlige brudd på opphavsretten. Nå har det skjedd en ny, oppsiktsvekkende utvikling i saken, rapporterer storavisen.
I et rettsdokument som nylig ble frigitt i redigert utgave, kommer det frem at Microsoft og Open AI var klar over at KI-treningen medfører brudd på opphavsretten i stor skala – og at selskapene selv var svært kritiske til sin egen praksis.
– Makeløse proporsjoner
Opplysningene stammer fra interne notater og kommentarer fra Microsoft som ikke tidligere har blitt delt med offentligheten.
– Denne saken handler om, som Microsofts sjef for anvendt vitenskap formulerte det, «et forbløffende tyveri av makeløse proporsjoner»; kanskje det «største tyveriet av arbeid i menneskets historie», skriver den saksøkende parten i det ferske rettsdokumentet.
Det hevdes at KI-selskapene gjentatte ganger kopierte flere millioner opphavsbeskyttede artikler i sin helhet fra The New York Times uten samtykke, for å produsere kommersielle KI-produkter som en erstatning for originalverkene.
I dokumentet vises det også til en kommentar som skal stamme fra Open AIs Chat GPT-sjef, hvor vedkommende innrømmer at KI-teknologien representerer en «eksistensiell trussel» mot forlagsbransjen. Den samme personen skal ha uttalt at KI-produktene fungerer som en erstatning for originalkildene, og at dette bare vil øke i omfang.
«Fair use»
Som en illustrasjon hevder avisen at klikkraten på originale artikler fra New York Times og øvrige medier via Bing-søkemotoren har gått ned med solide 83–93 prosent. Tallene skal ha blitt hentet inn via Microsofts
Copilot-tjeneste.
På bakgrunn av disse og andre opplysninger mener de saksøkende partene at «fair use»-forsvaret til KI-selskapene ikke holder vann.
I sin respons til New York Times-søksmålet har Open AI tidligere insistert på at treningen av KI-modellene på opphavsbeskyttet materiale faller under «fair use»-klausulen og at dette er en viktig praksis.
– Å trene KI-modeller ved hjelp av offentlig tilgjengelig materiale fra internett, er «fair use» slik dette støttes av langvarig og bredt akseptert rettspraksis. Vi mener at dette prinsippet er rettferdig overfor innholdsskapere, nødvendig for innovasjon og avgjørende for USAs konkurranseevne, skrev selskapet.
Kontroversielle roboter
Open AI peker på at selskapet benytter nettroboter («web crawlers») til å tråle og samle inn informasjon på nettet, men hevder de har gitt utgivere mulighet til å slippe unna denne praksisen.
New York Times hevder imidlertid at noen av disse nettrobotene likevel kommer seg rundt restriksjonene og samler inn data uten samtykke, inkludert informasjon som ligger bak betalingsmurer.
Disse nettrobotene har lenge vært kontroversielle, og internett-giganten Cloudflare har gått til «krig» mot fenomenet ved å blokkere KI-søkerobotene som standard for alle kundene sine. De mener det er et enormt problem at KI-tjenestene samler inn data uten å sende brukere til originalkildene.
– Originalt innhold er det som gjør internett til en av de største oppfinnelsene det siste århundret, og det er avgjørende at skapere fortsetter å lage det. KI-søkeroboter har hentet innhold uten grenser, skrev selskapet.