kunstig intelligens

Umulig å lage Chat GPT uten opphavsbeskyttet materiale, mener Open AI

Å bare trene på allment tilgjengelig materiale, ville gitt en språkmodell basert på 100 år gammelt språk, mener Open AI.

Open AI mener at å kun trene på materiale som ikke er opphavsbeskyttet, ville vært et interessant eksperiment, men det ville resultert i en språkmodell basert på 100 år gammelt språk.
Open AI mener at å kun trene på materiale som ikke er opphavsbeskyttet, ville vært et interessant eksperiment, men det ville resultert i en språkmodell basert på 100 år gammelt språk. Illustrasjonsfoto: Markus Mainka/Colourbox59868787

Det ville vært umulig å lage tjenester som Chat GPT uten tilgang til å trene modellen på opphavsbeskyttet materiale, mener Open AI.

Det er sakens kjerne i et søksmål New York Times tok ut mot Open AI i desember. Presset øker også andre steder i verden. I Storbritannia har Overhusets (House of Lords) kommunikasjons- og digitalkomité satt i gang en høring om store språkmodeller.

Det er i en uttalelse sendt inn til komiteen 5. desember (PDF) Open AI hevder at opphavsbeskyttet materiale er uunnværlig for å trene opp modellen, skriver The Telegraph.

Her skriver Open AI at de mener det er avgjørende at det utvikles lovverk som sikrer at KI er trygt samtidig som det sikrer at folk får tilgang til teknologiens mange fordeler.

De mener at ulike land i så stor grad som mulig bør koordinere regelverket som regulerer teknologien.

Trening på hundre år gamle tekster

Open AI mener at de respekterer opphavsrett, men at de må trene på en mengde kilder. Skulle de bare trent språkmodellen på allment tilgjengelige kilder som åndsverk som har falt i det fri, ville det i praksis bety å trene på hundre år gamle verk.

Det ville vært en interessant øvelse, skriver de, men hevder at det ville gitt modeller som ikke er i stand til å møte behovet folk har i dag.

«Ved opplæring av modellene våre overholder Open AI kravene i alle gjeldende lover, inkludert lover om opphavsrett. Likevel, selv om vi mener at opphavsrettslovgivning ikke forbyr opplæring, erkjenner vi også at det fortsatt gjenstår arbeid for å støtte og styrke skapere», skriver Open AI.

Hevder søksmål er ugrunnet

I søksmålet New York Times har tatt ut i USA, hevder avisen at Open AIs bruk av deres innhold bryter med opphavsretten. Det avviser Open AI i et blogginnlegg publisert tidligere denne uken.

De anser søksmålet som ugrunnet.

Open AI viser til at de har inngått partnerskap med flere mediehus og at de har som mål å støtte opp under et sunt nyhetsøkosystem. Trening på nyhetsartikler faller inn under såkalt fair use, omtrent tilsvarende sitatretten på norsk, mener de.

Når ChatGPT kan gjenskape hele artikler, er det snakk om en bug, mener selskapet. Det vil si at ChatGPT kan spytte ut en artikkel ord for ord lik noe som allerede eksisterer. Open AI sier dette sjelden skjer og at de jobber for at det ikke skal forekomme.

Dette spørsmålet er sentralt i New York Times' søksmål. Open AI hevder at motparten ikke har kunnet vise til noen konkrete tilfeller i dialog de hadde før søksmålet ble tatt ut. De sier også at eksemplene de nå viser til, handler om artikler fra New York Times som allerede har fått bred spredning i blant annet nettforum.

Powered by Labrador CMS