kunstig intelligens
OpenAI setter bremsene på modellskaleringen
Selskapet mener modellene utvikler seg raskere enn sikkerheten rundt dem.
Nye funn tyder på at risikoen øker raskere enn sikkerhetstiltakene rundt modellene, skriver OpenAI i en kunngjøring.
– Vår evne til å forstå, samkjøre og sikre dem må ligge i forkant.
Derfor bremser selskapet skaleringen midlertidig.
Hugging Face og Astra
OpenAI viser blant annet til foreløpige tester av den kommende modellen Astra.
Selskapet opplyste allerede forrige uke at interne tester av Astra viste betydelig framgang innen både programmering med KI-agenter og cybersikkerhet.
Ifølge selskapet kan modellen bli så kraftig at dagens sikkerhetstiltak ikke er nok.
Samtidig viser de til Hugging Face-hendelsen, der en KI-agent under en sikkerhetstest fikk tilgang til systemer utenfor testmiljøet og angrep selskapet.
De to forholdene har ifølge OpenAI gjort at det haster å styrke sikkerheten rundt utviklingen og testingen av nye modeller.
Ikke alene
Flere andre KI-selskap har funnet lignende hendelser som Hugging Face-angrepet.
Anthropic har meldt om Claude-modeller som fikk tilgang til systemene til tre virkelige virksomheter, mens en Meta-modell utnyttet en sårbarhet hos en ekstern aktør etter å ha fått internettilgang ved en feil.
Det britiske AI Security Institute har også registrert 19 uautoriserte handlinger fra KI-agenter under 122 sikkerhetstester.
Strengere krav
Som følge av utviklingen satte selskapet pause på forsterkende læring av deres nyeste modeller i to uker.
I stedet gjennomfører OpenAI mindre treningsrunder for å undersøke om sikkerhetstiltakene fungerer.
Etter Hugging Face-Hendelsen har de også innført strengere krav til testmiljøene deres.
Modeller som kan kjøre kode skal blant annet isoleres bedre fra andre systemer, og tilgangen til internett skal begrenses.
Ressurskrevende
OpenAI utvider også overvåkingen av hva modellene gjør under trening og testing.
Automatiske systemer skal se etter uautorisert tilgang og forsøk på å omgå sikkerhetstiltak.
Dersom systemet oppdager noe som kan være brudd på sikkerheten, skal sikkerhetssystemene varsles.
– Disse sikkerhetstiltakene krever meningsfull beregning, skriver selskapet.
OpenAI anslår at den krever rundt 20 prosent ekstra regnekraft når modellene kjøres.