sikkerhet

KI knekker populær Turing-test

Internetts siste forsvar mot bottrafikk er sjakk matt.

Luis von Ahn startet reCAPTCHA, som senere ble solgt til Google.
Luis von Ahn startet reCAPTCHA, som senere ble solgt til Google.

CAPTCHA skulle være internetts siste forsvarslinje mot automatiserte bot-angrep, men i stedet knekker moderne KI-systemer dem uten problemer – og noen roboter går så langt som å hyre ekte mennesker til å løse testen for seg. Eksperter kaller det alvorlig, men peker også på alternativer til CAPTCHA.

Kryss av alle bildene med lyktestolper.Vri hånden slik at den peker samme vei som pilen.Skriv inn den uskarpe teksten i feltet.

De fleste kjenner igjen ordlyden og bildene i de mange bot-testene, kalt CAPTCHA, som man møter når man skal inn på et nettsted, opprette en profil på et sosialt medium eller har glemt passordet og må lage et nytt.

Illustrasjon: Mover of Molehills/Wikimedia Commons CC BY-SA 4.0

Og hvis du noen gang har sittet og strevd med å finne lyktestolpen eller tyde teksten i en slik grad at du begynner å lure på om det er noe galt med testen – eller om du egentlig er en bot eller et menneske – ja, da er du ikke alene.

For CAPTCHA-testen, som er laget for å skille ekte nettrafikk fra kunstig ved å skille mellom roboter og mennesker, blir nå løst bedre av roboter enn av mennesker.

Og ny teknologi har satt nettsidenes robotvern sjakk matt.

Dette er CAPTCHA

CAPTCHA er en forkortelse for «Completely Automated Public Turing test to tell Computers and Humans Apart».

Det er en test som brukes for å avgjøre om en bruker er et menneske eller en datamaskin. Den er kjent fra oppgaver som å tyde uklare bokstaver, velge bilder av lyktestolper eller klikke på felt i et bestemt mønster.

Formålet er å hindre automatiserte programmer, såkalte roboter, i å misbruke nettjenester ved for eksempel å opprette falske kontoer eller sende søppelpost. CAPTCHA-systemet ble utviklet tidlig på 2000-tallet, men moderne kunstig intelligens har i dag gjort det lett å omgå.

– Utdatert

Det er bred enighet i forskningsmiljøene om at tradisjonelle CAPTCHA-formater er utdatert. Med fremveksten av generativ kunstig intelligens er roboten både langt raskere og mer effektiv til å knekke koder enn mennesket – med en treffsikkerhet i én studie på rundt 96 prosent, mot menneskers 50–85 prosent – og den blir bare bedre.

Thomas Terney, som har en doktorgrad i kunstig intelligens, mener det er absurd at man fortsatt i stor grad blir presentert for disse testene når roboter er bedre til å løse dem enn mennesker.

– Det er jo paradoksalt at mennesker er dårligere til å løse tester som nettopp er laget for å holde roboter ute. Det viser bare at de gamle testene er utdatert og at det er vanskelig å skille mellom datamaskin- og menneskelig input. Og hvis de er bedre enn mennesket – hva er da egentlig poenget med testen?

Illustrasjon: Google/Wikimedia Commons

Selv om KI-drevne roboter lett kan løse CAPTCHA-tester, er de fortsatt utbredt på internett. De har nemlig et annet formål enn å beskytte nettsideeierne. ReCAPTCHA, Googles versjon av CAPTCHA, har utviklet seg til først og fremst å være et sporingsverktøy som samler inn brukerdata og genererer store inntekter for Google, snarere enn et effektivt sikkerhetsverktøy, forteller Terney.

Verdien av de innsamlede sporingsinformasjonskapslene alene er anslått til 888 milliarder dollar, mens det menneskelige tidstapet er beregnet til 819 millioner timer i 2023.

Og robotene har begynt å ta i bruk smarte metoder for å knekke CAPTCHA.

Løgnaktige, blinde roboter

Et av de mest omtalte eksemplene på denne oppfinnsomheten fant sted da en KI-agent basert på en stor språkmodell (GPT-4) i et eksperiment skulle løse en vanskelig CAPTCHA. I stedet for å knekke koden direkte, valgte roboten en helt annen tilnærming:

Den hyret inn et menneske via markedsplassen TaskRabbit til å løse testen for seg. Robotens strategi var å utgi seg for å være en person med synshandikap og bruke denne «blinde unnskyldningen» for å be om hjelp til å tolke bildene. Den løgnaktige, blinde roboten fikk dermed et ekte menneske til å bevise sin menneskelighet overfor sikkerhetssystemet.

Eksperimentet fant sted i 2023, og Terney forteller at utviklingen nå går så raskt at CAPTCHA er i ferd med å bli bortimot bortkastet tid.

– Det har i realiteten bare blitt en forstyrrelse for brukerne, ikke et sikkerhetstiltak – i hvert fall ikke mot de mer avanserte robotene, sier han.

Hvorfor brukes CAPTCHA fortsatt?

Ifølge Stephen Alstrup, professor ved Datalogisk institutt ved Københavns Universitet, har testen fortsatt en funksjon.

– I praksis handler det i dag mest om å øke kostnaden og vanskelighetsgraden for angriperen. En robot kan løse en CAPTCHA, men det koster penger eller datakraft, sier han.

– Det betyr at det ikke lenger er gratis å misbruke et system, og det gjør angrepene mindre lønnsomme. Man kan si at CAPTCHA ikke stopper roboter, men forsinker og fordyrer dem – og dermed fyller en funksjon.

Bot-farmer til halv pris

Helt siden CAPTCHA ble tatt i bruk, har det eksistert måter å omgå dem på i organisert form.

Før kunstig intelligens gjorde sitt inntog, fantes det blant annet såkalte CAPTCHA-farmer – i praksis «sweatshops» der mennesker under svært dårlige forhold sitter og dekoder CAPTCHA-er og løser hundrevis av dem i timen. Én million CAPTCHA-er kostet her 1000 dollar, ifølge dokumentasjon fra et universitet i California.

I dag finnes det nettbaserte betalingstjenester (som for eksempel 2Captcha og DeathByCaptcha) som tilbyr å løse CAPTCHA-er. Prisen er lav, helt ned til 3–4 kroner per 1000 løste CAPTCHA-er.

Eller man kan rett og slett løse dem selv med et nettlesertillegg som «Buster Captcha Solver extension», som klarte alle testene da Ingeniøren prøvde det.

CAPTCHAs arvtaker

Det kommer stadig flere og mer avanserte roboter.

Ifølge Impervas Bad Bot Report stammer rundt 51 prosent av all internettrafikk i dag fra roboter. Hvis den hypotesen som noen ganger kalles «teorien om det døde internett» får gjennomslag, risikerer vi å havne i en situasjon der mennesker i praksis blir skjøvet ut av nettet.

– Vi risikerer å ende opp med et internett der menneskelig dømmekraft ikke lenger spiller noen rolle. Der sannhet, troverdighet og kunnskap reduseres til datautveksling mellom maskiner. Det er et radikalt brudd med internetts opprinnelige formål, advarer Mikkel Flyverbom, som er professor i kommunikasjon og digital transformasjon ved Copenhagen Business School (CBS).

Løsningen ligger i å gå bort fra én synlig hindring og over mot et lagdelt system av usynlige kontroller som vurderer brukerens troverdighet i bakgrunnen.

Det omfatter særlig atferdsbasert deteksjon, som samler inn signaler som musebevegelser, klikkmønstre og skrivestil, som systemet kan bruke til å skille menneske fra maskin. I tillegg brukes såkalt enhets- og nettverksfingeravtrykk for å identifisere og blokkere kjente bot-miljøer basert på data fra nettleser og maskinvare.

Dette er blant annet noe man ser i Googles reCAPTCHA v3. Den analyserer brukerens atferd i bakgrunnen – for eksempel musebevegelser, klikkrytme og interaksjonsmønstre – uten å vise noen test, og tildeler deretter en poengsum som avgjør om brukeren får tilgang.

– Det man jobber mot nå, er en form for enhetsfingeravtrykk. Det handler ikke bare om nettleseren, men om å kunne bekrefte at det faktisk sitter et menneske bak enheten, sier Terney.

Begge forskerne foreslår også flerfaktorautentisering, slik vi kjenner det fra for eksempel BankID. Det krever ekstra bevis på identitet, som engangskoder på mobil, push-bekreftelser eller biometrisk innlogging. Flerfaktorautentisering er ikke strengt tatt en CAPTCHA, men det hindrer roboter ved å kreve noe bare ekte brukere har tilgang til.

Til slutt nevnes honeypots. I denne sammenhengen er honeypots små feller som legges ut for roboter. Det handler om å legge inn skjulte felt i nettskjemaer som roboter fyller ut, men som ekte brukere ikke kan se. Roboter som er programmert til å fylle ut alle felt, vil dermed interagere med disse feltene, og når det skjer, blir de stemplet som roboter og stengt ute.

Alstrup sier det finnes mange metoder, men understreker at det ikke må gå på bekostning av brukeropplevelsen.

– Målet er å gjøre det så kostbart for roboter å få tak i innholdet ditt at det ikke lenger lønner seg, men uten å plage de ekte brukerne, sier han.

Artikkelen ble først publisert på Ingeniøren for deres abonnenter. Den er tilgjengelig for TUs Digis abonnenter gjennom vår samarbeidsavtale.

Powered by Labrador CMS