kunstig intelligens
Snart kan KI avbryte deg mens du snakker
Thinking Machines viser frem «interakasjonsmodeller» som skal gjøre KI-samtaler svært naturlige.
Det særegne ved de moderne KI-språkmodellene er evnen til å føre svært naturlige og realistiske samtaler med mennesker, men det finnes de som ønsker å gjøre KI-samtalene enda mer smidige og menneskelignende.
Thinking Machines er navnet på et nytt KI-selskap som ble grunnlagt i fjor av Mira Murati, som tidligere jobbet som teknologisjef hos Open AI før hun valgte å gå sin egen vei.
Det nye oppstartsselskapet har den siste tiden jobbet med noe de kaller «interaksjonsmodeller» – som i grove trekk er KI-modeller som spesialiserer seg på naturlig interaksjon.
Responderer og handler i sanntid
Tanken bak konseptet er å la mennesker snakke og samhandle med KI på akkurat samme måte som man gjør med andre mennesker.
Det innebærer først og fremst at KI-modellen ikke trenger å «vente» på å bli aktivert med en «prompt» før den deltar – som er den store akilleshælen som ennå forhindrer KI-modellene i å føles som «ekte» samtalepartnere.
– Interaksjonsmodeller lar mennesker samarbeide med KI på samme måte som vi naturlig samarbeider med hverandre – de tar kontinuerlig inn lyd, video og tekst, og tenker, responderer og handler i sanntid, heter det i selskapets forklaring.
Thinking Machines' tilnærming til kunstig intelligens springer ut fra ideen om at KI-selskaper generelt fokuserer langt mer på å gjøre KI-modellene mest mulig autonome – selvstyrte – i stedet for å legge til rette for å bevare den menneskelig deltakelsen. Det er altså her fokuset på interaksjon kommer inn i bildet.
Selskapet peker på at moderne KI-modeller er nødt til å vente på brukeren uten noe oppfatning av hva brukeren gjør i mellomtiden, og den mottar ingen ny informasjon før den er ferdig med å generere et svar eller blir avbrutt.
Blir tilgjengelig senere i år
Thinking Machines akter å løse dette ved å gjøre kunstig intelligens interaktiv i sanntid på tvers av både tekst, lyd, bilde og eventuelt andre kanaler.
Modellene selskapet jobber med, som ennå kun eksisterer i en tidlig forskningsversjon, skal bli i stand til å hoppe inn i samtaler uten å vente på at brukeren gjør seg ferdig, og den kan snakke samtidig med brukeren – for eksempel ved sanntidsoversettelser.
Modellene skal også ha en forståelse av tid, og de skal også kunne forstå brukerens adferd – for eksempel hvorvidt brukeren venter på svar, tenker, eller korrigerer seg selv. I tillegg skal de kunne søke på nettet og utføre andre oppgaver mens den snakker med og lytter til brukeren.
Selskapet har publisert en rekke videoer på nettsidene sine som demonstrerer en tidlig versjon av teknologien, men det påpekes at mye arbeid gjenstår.
Thinking Machines sier de skal gjøre en forskningsutgave av modellen tilgjengelig for andre i løpet av de kommende måneden for å samle tilbakemeldinger. En bredere lansering skal komme senere i år, men det er uvisst når vanlige brukere eventuelt vil få tilgang til teknologien.