kunstig intelligens

Google tror dette nye KI-verktøyet bringer oss nærmere AGI

Viste frem Genie 2, som kan plassere KI-agenter i en 3D-verden.

Genie-2 er navnet på Googles/Deepminds nye KI-verktøy, som potensielt kan gi oss langt mer avanserte KI-agenter.
Genie-2 er navnet på Googles/Deepminds nye KI-verktøy, som potensielt kan gi oss langt mer avanserte KI-agenter.

KI-kappløpet går unna så det ryker, og nå er det Googles tur til å vise frem noen av nyvinningene som selskapet har jobbet med via sitt britiske datterselskap DeepMind.

Genie-2 er navnet på et potent KI-verktøy som Google avduket denne uken. Produktet er en langt mer avansert oppfølger til Genie, et verktøy som kan lage enkle, todimensjonale dataspill ved hjelp av ett enkelt bilde.

3D-treningsverktøy for KI-agenter

Genie-2, som tar steget opp til tre dimensjoner, er i korte trekk en ny tilnærming til trening av KI-agenter – som blir stadig viktigere på KI-fronten. Modellen er det Google på originalspråket kaller en «large-scale foundation world model», eller grunnleggende verdensmodell på norsk.

Den er ment å bli brukt til trening og evaluering av KI-agenter, men med den noe unike vrien at treningen skjer i et interaktivt 3D-miljø hvor brukeren eller KI-agenten kan utføre en lang rekke forskjellige handlinger gjennom tekstinstrukser.

Google forklarer at Genie-2 kan simulere virtuelle verdener, noe som også inkluderer konsekvensene av ulike handlinger, som for eksempel hopping og svømming.

Modellen er trent på et stort videodatasett og er i stand til både interaksjon med objekter, komplisert karakteranimasjon, fysikk og evnen til å modellere og dermed forutsi oppførselen til andre agenter, sier selskapet.

Genie-2 kan modellere en lang rekke fenomener som vanneffekter, gravitasjon, røykeffekter, lys og refleksjoner. Den kan også modellere andre agenter og avanserte interaksjoner med disse.

Eksempler på interaktive 3D-miljøer som er generert med enkle tekstinstrukser. Foto: Google/Deepmind
Eksempler på interaktive 3D-miljøer som er generert med enkle tekstinstrukser.

– Gjør fremskritt mot AGI

Brukeren kan beskrive verdenen de ønsker seg med ren tekst, litt på samme måte som man kan gjøre med bilder i andre KI-modeller, og deretter velge sin favorittgjengivelse av ideen. Så kan man gå inn i og samhandle med den nyopprettede verdenen, eller eventuelt la en KI-agent trenes eller evalueres i den.

Google sier at Genie-2 reagerer «intelligent» på handlinger som utføres ved å trykke på tastene på et tastatur, identifisere figuren og bevege den på korrekt måte.

Selskapet mener den nye modellen representerer et viktig bidrag til det mangfoldet de mener er nødvendig for en dag å oppnå AGI, eller kunstig, generell intelligens – den neste «hellige gralen» innen KI.

– Selv om denne forskningen fortsatt er i en tidlig fase med betydelig rom for forbedring både når det gjelder agent- og miljøgenereringskapasiteter, tror vi at Genie-2 representerer veien til å løse det strukturelle problemet med å trene inkorporerte agenter på en trygg måte, samtidig som den oppnår bredden og generaliteten som kreves for å gjøre fremskritt mot AGI, skriver Google.

Genie-2 er altså ennå hovedsakelig et forskningsprosjekt, og det er uvisst akkurat når og hvordan teknologien blir bredt tilgjengelig.

Flere detaljer om hvordan det hele fungerer, finner man på Googles nettsider.

Powered by Labrador CMS