kunstig intelligens
Slik skal Chat GPT-brukerne beskyttes mot en stor sikkerhetstrussel
Lanserer «nedstengningsmodus» og mer til KI-tjenesten.
Etter hvert som KI-tjenestene utstyres med stadig flere funksjoner og egenskaper, øker også sikkerhetstruslene i omfang. Nå ønsker Open AI å komme ondsinnede aktører i forkjøpet på sin egen Chat GPT-plattform.
På de offisielle nettsidene sine avduket selskapet nylig en ny Chat GPT-funksjon døpt «Lockdown Mode», eller nedstengningsmodus, til KI-tjenesten sin. Modusen er ment å beskytte mot den svært alvorlige «prompt injection»-trusselen som de nye KI-tjenestene har åpnet for.
Dette er i korte trekk en angrepstype hvor ondsinnede aktører «hacker» et KI-system/agent til å ignorere regler og sikkerhetsmekanismer for å utføre oppgaver den ikke er ment å utføre.
Blokkerer funksjoner
Dette skjer ved å legge inn presise, nøye utformede instruksjoner som er designet for å villede eller forvirre KI-systemet. Instruksjonene kan skrives direkte inn i KI-chatsamtaler, men kan også for eksempel skjules på nettsider og i skjermbilder.
Lockdown-modusen er en valgfri, avansert sikkerhetsinnstilling som fungerer ved å legge strenge begrensninger på måten Chat GPT samhandler med eksterne systemer på.
– Lockdown-modus deaktiverer deterministisk visse verktøy og funksjoner i Chat GPT som en ondsinnet aktør kan forsøke å utnytte for å hente ut sensitiv data fra brukeres samtaler eller tilkoblede apper via angrep som «prompt injections», forklarer Open AI.
Med modusen aktivert vil nettsurfing for eksempel begrenses til innhold som er bufret, altså data som er lagret lokalt eller midlertidig, slik at ingen direkte nettverksforespørsler sendes ut av Open AIs eget nettverk.
App-tilkoblinger øker trusselen
Dette reduserer trusselen ved at de ondsinnede aktørene har færre muligheter til å utføre «prompt injection»-angrep ved å manipulere eksterne nettsider og tjenester som Chat GPT kommuniserer med.
Dette er særlig relevant med tanke på at Chat GPT, og for den saks skyld andre KI-tjenester, nå er utstyrt med evnen til å koble seg til tredjepartsapplikasjoner direkte fra chatvinduet – noe som øker sjansen for å hente ut sensitive data fra disse appene.
Modusen sørger også for at Chat GPTs svar ikke inneholder bilder, og både «deep research»- og «agent»-modusene deaktiveres. I tillegg vil man ikke kunne laste ned filer for analyse, men Chat GPT kan fremdeles jobbe på filer som brukeren laster opp manuelt.
Når det gjelder «prompt injection»-angrep generelt har også de såkalte KI-nettleserne økt denne trusselen betydelig på grunn av de innebygde agentiske (autonome) egenskapene til nettleserne, som Open AI selv har belyst. I den forbindelse innrømmet Open AI at trusselen aldri kan elimineres helt.
Stor bekymring
– Vi venter at ondsinnede aktører vil fortsette å tilpasse seg. «Prompt injection», akkurat som svindel og sosial manipulering, vil trolig aldri bli helt «løst», skrev selskapet.
En rekke andre teknologi- og sikkerhetsaktører har også omtalt trusselen som en av de mest presserende innen KI-tjenester.
– Prompt injection-sårbarheter er en stor bekymring for KI-sikkerhetsforskere fordi ingen har funnet en idiotsikker måte å håndtere dem på. Prompt-injection utnytter en kjerneegenskap ved generative KI-systemer; evnen til å svare på brukernes instruksjoner formulert i naturlig språk, skrev for eksempel IBM i en temaartikkel.
Lockdown-modusen blir først tilgjengelig for Chat GPT Enterprise, Chat GPT Edu, Chat GPT Healthcare og Chat GPT for Teachers., men ifølge Open AI er planen å gjøre modusen tilgjengelig også for vanlige brukere i løpet av de kommende månedene.