For å lese artikler må du være abonnent

50 kr for 5 uker

  • Full tilgang til TU.no og Digi.no
  • Artikkelarkiv helt tilbake til 1854
  • Eksklusive nyhetsbrev

Deretter 299 kr/mnd. Fornyes automatisk, avslutt når du vil.

PRØV OSS I 5 UKER

2990 kr / år

  • Full tilgang til TU.no og Digi.no
  • Artikkelarkiv helt tilbake til 1854
  • Eksklusive nyhetsbrev
  • Spar 598 kr

Fornyes automatisk til ordinær pris, avslutt når du vill.

BESTILL NÅ

Bedrift eller student?

  • Sjekk om du har tilgang via arbeidsgiver
  • Pristilbud til din bedrift
  • Innløs din gratis studenttilgang

Tilgang avhenger av avtalen med din arbeidsgiver eller ditt studiested.

LES MER HER

analyse

Skrapesjuken

Det åpne nettet har blitt en beitemark for milliardindustriens datasultne modeller.
Det åpne nettet har blitt en beitemark for milliardindustriens datasultne modeller. Illustrasjonsfoto: Heiko Junge/NTB

Trening av store språkmodeller bygger i hovedsak på innhold laget av andre. Det hentes enorme mengder fra åpne kilder på nettet.

Det inkluderer bruk av opphavsrettsbeskyttet materiale, eller trening på lisensbeskyttet innhold uten kreditering, som kan oppfattes som juridiske gråsoner. I USA forsvarer teknologiselskapene seg med «fair use», mens rettighetshavere hevder at det er tyveri.

Store norske leksikon (SNL), en ideell forening, erfarte at Open AI, milliardselskapet bak Chat GPT, lastet ned anslagsvis 30 millioner artikler. Leksikonet består av 200.000 tekster. Hvorfor én aktør skal ha lastet ned SNLs artikler i et slikt omfang, er uklart, men redaktør Erik Bolstad kaller det umoralsk.

Powered by Labrador CMS