operativsystemer og programvare
Schibsted delte interne notater med Open AI: – Vanlig feil, sier Datatilsynet
Open AI skulle få tilgang til artikler fra Schibsted. I stedet ble også de interne kommentarene i skriveverktøyet tilgjengelige.
Open AI har hatt tilgang til interne kommentarer i Schibsted-avisenes redaksjonelle systemer i over ett år. I disse interne kommentarene er det gjerne tittelforslag, overleveringsinformasjon, kontaktinformasjon til kilder, kladder og deler av teksten som er redigert ut.
Årsaken var en feil i API-et som Schibsted hadde satt opp for å dele innhold med Open AI, skriver Morgenbladet.
Vanlig feil
– Dette ble oppdaget internt i forbindelse med arbeid og gjennomgang knyttet til integrasjonen mot Open AI, skriver Schibsteds kommunikasjonssjef Bjørn-Martin Bache Nordby til Digi.
Han forklarer at feilen skyldtes at de interne kommentarene ikke var ekskludert fra metadataene som ble tilgjengelige gjennom API-et.
En vanlig feil, spør du Eirik Gulbrandsen, spesialistrådgiver i Datatilsynet.
Et API er et standardisert grensesnitt som lar ulike datasystemer utveksle informasjon, ifølge nettsiden Scrapingbee. Når du for eksempel går inn på værappen, vil den hente de nyeste værdataene fra en annen tjeneste ved hjelp av et API.
– Problemet oppstår når systemet bak API-et inneholder mer informasjon enn det var ment til å dele, sier Gulbrandsen.
– Da kan API-et begynne å sende med overskuddsinformasjon. Altså metadata eller interne felt som ikke skulle vært tilgjengelige.
I Schibsteds tilfelle er det snakk om de interne kommentarene i skriveverktøyet. Informasjon som ikke er ment for publisering.
– Vi kan ikke klandre Open AI
Nordby i Schibsted forklarer at de har gjennomgått den tekniske løsningen, kontrollrutinene og de organisatoriske prosessene rundt integrasjonen av Open AI.
– Dette for å forstå mer av bakgrunnen og for å sikre at tilsvarende feil ikke skjer igjen.
Hendelsen er imidlertid ikke meldt inn til Datatilsynet fordi Schibsted mener terskelen for varsling etter personvernreglene ikke er oppfylt.
– Basert på de bekreftelsene vi har mottatt og de undersøkelsene vi selv har gjort, er dataene ikke blitt brukt eller gjort tilgjengelige videre, skriver Nordby.
Han forklarer at de også har iverksatt avbøtende tiltak, inkludert sletting av data.
– Hadde dere noen kritiske tanker rundt samarbeidet med Open AI?
– Schibsted gjorde grundige vurderinger på en rekke områder før avtalen ble inngått, svarer Nordby.
Han opplyser også at avtalen er tidsbegrenset, slik at Schibsted kan evaluere samarbeidet før en eventuell forlengelse.
Samtidig understreker han at Schibsted selv har ansvaret for hvilke data som deles gjennom selskapets API-er.
– Vi kan ikke klandre Open AI for denne uheldige hendelsen, ettersom det er Schibsted som til enhver tid bestemmer hvilke data vi deler gjennom vårt eget API, skriver Nordby.
Ifølge Schibsted har Open AI opplyst at de interne kommentarene automatisk ble filtrert bort fordi de ikke var relevante, og at de verken ble brukt i tjenester eller eksponert videre.
– Våre egne undersøkelser og tester bekrefter også dette, skriver Nordby.
Tre tips til sikker API
Gulbrandsen i Datatilsynet mener dette ofte handler om manglende «innebygd personvern», at personvern og tilgangsstyring ikke er godt nok bygget inn i systemdesignet.
– Det er også typisk å lage et API for ett konkret formål, se at det fungerer, og så begynne å bruke det i andre sammenhenger uten at sikkerhetsmekanismene oppdateres, forklarer Gulbrandsen.
For å unngå slike feil trekker han fram tre sentrale tiltak.
– Det ene er å sikre at riktig kontekst skal få riktig informasjon, sier Gulbrandsen.
For eksempel at Open AI skal få tilgang til publiserte artikler, men ikke interne notater.
– Det andre handler om tilgangsstyring, altså hvem som får se hva, forklarer han.
I tillegg mener han det er viktig med tydelige avtaler om hvilke opplysninger som kan deles, og hvordan de kan brukes.
Gulbrandsen understreker samtidig at ansvaret ligger hos begge parter i et slikt samarbeid, selv om API-et tilhører Schibsted.
Han forklarer at den som tilbyr API-et, har ansvar for hvilke data som deles, mens databehandleren, i dette tilfellet Open AI, ikke skal behandle mer informasjon enn avtalen åpner for.