kunstig intelligens

OpenAI setter bremsene på modellskaleringen

Selskapet mener modellene utvikler seg raskere enn sikkerheten rundt dem.

Sam Altman leder OpenAI, som nå bremser utviklingen av sine kraftigste KI-modeller.
Sam Altman leder OpenAI, som nå bremser utviklingen av sine kraftigste KI-modeller.

Nye funn tyder på at risikoen øker raskere enn sikkerhetstiltakene rundt modellene, skriver OpenAI i en kunngjøring.

– Vår evne til å forstå, samkjøre og sikre dem må ligge i forkant.

Derfor bremser selskapet skaleringen midlertidig.

Hugging Face og Astra

OpenAI viser blant annet til foreløpige tester av den kommende modellen Astra.

Selskapet opplyste allerede forrige uke at interne tester av Astra viste betydelig framgang innen både programmering med KI-agenter og cybersikkerhet.

Ifølge selskapet kan modellen bli så kraftig at dagens sikkerhetstiltak ikke er nok.

Samtidig viser de til Hugging Face-hendelsen, der en KI-agent under en sikkerhetstest fikk tilgang til systemer utenfor testmiljøet og angrep selskapet.

De to forholdene har ifølge OpenAI gjort at det haster å styrke sikkerheten rundt utviklingen og testingen av nye modeller.

Ikke alene

Flere andre KI-selskap har funnet lignende hendelser som Hugging Face-angrepet.

Anthropic har meldt om Claude-modeller som fikk tilgang til systemene til tre virkelige virksomheter, mens en Meta-modell utnyttet en sårbarhet hos en ekstern aktør etter å ha fått internettilgang ved en feil.

Det britiske AI Security Institute har også registrert 19 uautoriserte handlinger fra KI-agenter under 122 sikkerhetstester.

Strengere krav

Som følge av utviklingen satte selskapet pause på forsterkende læring av deres nyeste modeller i to uker.

I stedet gjennomfører OpenAI mindre treningsrunder for å undersøke om sikkerhetstiltakene fungerer.

Etter Hugging Face-Hendelsen har de også innført strengere krav til testmiljøene deres.

Modeller som kan kjøre kode skal blant annet isoleres bedre fra andre systemer, og tilgangen til internett skal begrenses.

Ressurskrevende

OpenAI utvider også overvåkingen av hva modellene gjør under trening og testing.

Automatiske systemer skal se etter uautorisert tilgang og forsøk på å omgå sikkerhetstiltak.

Dersom systemet oppdager noe som kan være brudd på sikkerheten, skal sikkerhetssystemene varsles.

– Disse sikkerhetstiltakene krever meningsfull beregning, skriver selskapet.

OpenAI anslår at den krever rundt 20 prosent ekstra regnekraft når modellene kjøres.

Powered by Labrador CMS