kunstig intelligens

Alle snakker om KI-agenter – men hva er det egentlig?

Teknologigigantene bygger dem, oppstartsbedrifter prøver å være først med dem, og alle snakker om dem. Men hva er egentlig AI-agenter, hvordan skiller de seg fra chatboter, og hvordan fungerer de?

«Alle» snakker om KI-agenter. Her er svaret på seks spørsmål som gjør det litt lettere å skjønne hva det handler om.
«Alle» snakker om KI-agenter. Her er svaret på seks spørsmål som gjør det litt lettere å skjønne hva det handler om.

Ordet agent kommer fra latin agere, som betyr «å drive, lede, føre, håndtere, utføre, gjøre». Verbene er i denne sammenhengen passende og viser at det dreier seg om noe annet enn en moderne chatbot. Forskere hos Google Deepmind definerer hva som kjennetegner en KI-agent på denne måten: Den har et naturlig språkgrensesnitt og «er designet til å planlegge og utføre handlinger på vegne av brukeren i flere domener». Handlingene må være «i samsvar med brukerens forventninger».

En KI-agent skal være utstyrt med generelle evner, kunne handle autonomt og være fleksibel. Oppgavene kan handle om å hente informasjon, ta beslutninger og interagere med brukeren.

Hva består en AI-agent av?

Det er en multimodal modell, noe som innebærer at den kan behandle tekst, bilde, lyd med mer. Den har både korttids- og langtidsminne. Den er utstyrt med verktøy som lar den behandle data fra for eksempel kalendere, kalkulatorer, kodemiljør og søkemotorer.

En KI-agent må også kunne planlegge, vurdere ulike muligheter og arbeide i flere trinn, både fremover og bakover. Jeg gjorde for noen dager siden noe så enkelt som å kjøpe et nytt TV-spill på nettet, og det omfattet mer enn ti handlinger (finne spillet, legge i handlekurven, velge betalingsmetode osv.). La oss si at jeg ved å klikke på handlekurven innså at jeg hadde lagt feil spill i den. En enkel sak for meg å rette opp, men foreløpig en tøff oppgave for kunstig intelligens. De KI-modellene som finnes på markedet nå, mangler fortsatt mye når det gjelder å kunne planlegge. For øyeblikket bruker utviklere tilleggs-algoritmer for å komme rundt begrensningene.

Hvordan da?

Det finnes både lenge utprøvde metoder (Monte Carlo-søk, forsterkende læring) og nyere varianter (Tree of Thought, Reflexion) for å få en KI-agent til å «tenke før den handler». Med forsterkende læring lærer modellen via prøv og feil (trial and error). Med Monte Carlo-søk simuleres mulige fremtidige scenarier.

Det interessante med de nyere algoritmene er at de kan dra nytte av språkmodellens evne. Reflexion, for eksempel, bruker «verbal forsterkende læring», der agentene «reflekterer» over sin innsats ved hjelp av naturlig språk. Forskerne skriver at dette «minner om hvordan mennesker lærer å utføre kompliserte oppgaver på få forsøk. Ved å reflektere over tidligere feil kan mennesker lage en ny, forbedret plan for neste forsøk.»

Hvilke muligheter har KI-agenter?

Det er det både vanskelig å få oversikt over og vanskelig å forutsi. KI-agenter kan brukes på mange områder som i dag krever menneskelig arbeidskraft. Vi vet ikke hvor kort eller lang tid det tar for KI-modeller å nærme seg, oppnå eller passere generell intelligens.

Men hvis man skal sammenligne med dagens autonome systemer, skal KI-agenter i mindre grad trenge å måtte stole på menneskelig inngripen. De skal forstå sammenhenger over tid, interagere og koordinere med andre KI-agenter, kunne ta proaktive beslutninger, lære av sine erfaringer og integrere kunnskap fra ulike domener.

Helst skal de også kunne bidra med helt ny kunnskap, men om det i det hele tatt er mulig og når det i så fall kan skje, er åpne spørsmål.

Microsoft er et av selskapene som satser på KI-agenter. Her er Microsoft-sjef Satya Natella på selskapets Build-konferanse tidligere i år. Foto: Microsoft
Microsoft er et av selskapene som satser på KI-agenter. Her er Microsoft-sjef Satya Natella på selskapets Build-konferanse tidligere i år.

Et system med generell intelligens kan sannsynligvis utføre de oppgavene mennesker for øyeblikket utfører i digitale miljøer. Et legemliggjort generelt intelligent system (som for eksempel en humanoid robot) kan på tilsvarende måte utføre oppgaver i den fysiske verden.

Hvilke risikoer er forbundet med AI-agenter?

Hvor skal man begynne?

For eksempel personvern. For at KI-agenter skal bli så nyttige som mulig, må de behandle store mengder data. Hvis det dreier seg om agenter for enkeltbrukere, må de – for å være mest nyttige – ha tilgang til store mengder personlig informasjon. Mange av oss vil gladelig gå med på det fordi vi anser fordelene som store. Men hvor lagres alle disse dataene, hvem har tilgang til dem, og hvordan kan de misbrukes?

En annen åpenbar risiko: KI-agenter som brukes til cyberangrep og spredning av desinformasjon. Deretter kommer man inn på mer alvorlige (men foreløpig hypotetiske) risikoer. Hvis KI-agenten har fått en oppgave, et mål å oppnå, gjelder det at målet er i samsvar med brukerens intensjoner. Det kan være vanskelig å spesifisere mål og samtidig forutse alle konsekvenser. Spørsmålet er også hvilke tiltak et generelt intelligent system kan tenkes å iverksette for å oppnå sitt mål. Her nærmer vi oss diskusjonen om hvorvidt kunstig intelligens kan utgjøre en katastrofal eller til og med eksistensiell trussel.

Dette hører delvis sammen med faren for sosial manipulasjon. Det finnes allerede eksempler på mennesker som har latt seg overbevise om at eksisterende KI-modeller er bevisste. Mer avanserte modeller vil sannsynligvis være svært overbevisende, men kanskje sendt ut på oppdrag av individer, grupper eller stater med en spesiell agenda. Det finnes også en hypotetisk risiko for at KI-modellene på eget initiativ (for å oppnå sine mål) manipulerer brukeren.

Hvem utvikler KI-agenter?

Både Microsoft og Google er i full gang med arbeidet, samt rene KI-selskaper som Open AI og Anthropic. I tillegg finnes det en hel rekke oppstartsbedrifter som haster i vei for å bli først til fremtiden.

Men om 2023 ble kalt «chatbotens år», er det for tidlig å si om 2024 blir KI-agentens år. Foreløpig finnes det ikke noe som kan anses som revolusjonerende. Og det gjenstår å se hva som blir mulig når neste generasjon KI-modeller lanseres.

Artikkelen ble først publisert på Ny Teknik for deres abonnenter. Den er tilgjengelig på norsk for abonnenter av Ekstra gjennom vår samarbeidsavtale.

Powered by Labrador CMS