kunstig intelligens

Open AI har lansert ny KI-modell som «tenker» før den svarer – skilter med heftig ytelse

«OpenAI o1» er den første i en serie av nye, avanserte modeller.

Den nye KI-modellen OpenAI o1 løfter ytelsen kraftig på en del områder.
Den nye KI-modellen OpenAI o1 løfter ytelsen kraftig på en del områder.

For bare dager siden rapporterte Digi.no at Open AI hadde planer om å lansere en ny modell som er i stand til å resonnere på et langt høyere nivå enn eksisterende modeller. Allerede nå ser det ut til at Open AI har dratt sløret av nyvinningen sin.

På den offisielle bloggen sin har selskapet kunngjort «OpenAI o1», som er den første av en ny serie KI-modeller som ifølge Open AI skal «tenke» før den svarer.

Gjør det svært godt i koding og matematikk

– Vi trente disse modellene til å bruke mer tid på å tenke gjennom problemer før de svarer, på samme måte som et menneske ville gjort. Gjennom trening lærer de å raffinere tankeprosessen sin, prøve forskjellige strategier og gjenkjenne feilene sine, heter det i beskrivelsen.

Ifølge Open AI har den nye modellen allerede gjort det skarpt i diverse tester. I ytelsesmålinger som tester ferdigheter innen fysikk, kjemi og biologi skal den yte på nivå med doktorgradsstudenter, og også innen matematikk og koding skal den ha utmerket seg stort.

Open AI hevder at den nye o1-modellen havnet i 89. prosentil på Codeforces, en plattform hvor det arrangeres konkurranser innen programmering.

Til sammenligning kom den velkjente modellen GPT-4o ikke lenger enn til 11. prosentil i den samme Codeforces-konkurransen. Dermed snakkes vi altså om en betydelig ytelsesforskjell innen koding.

Når det gjelder matematikk har modellen ifølge Open AI plassert seg blant de 500 beste deltakerne i en kvalifisering til USA Math Olympiad, som er en svært prestisjetung matematikkonkurranse i USA.

I denne konkurransen skal den nye modellen ha løst 83 prosent av matematikkoppgavene, mens GPT-4o kun oppnådde en suksessrate på 13 prosent.

Mangler ennå funksjoner

Også i såkalte «human preference»-tester, altså tester hvor mennesker evaluerer anonymiserte responser på bestemte instruksjoner fra modellene, gjorde den nye OpenAI o1-modellen det vesentlig bedre enn GPT-4o.

Flere detaljer og resultater rundt de ulike testene den nye modellen er kjørt gjennom, kan man finne på denne siden.

Mye arbeid gjenstår imidlertid, og modellen er langt fra ferdig. Enn så lenge kan den for eksempel ikke surfe på internett for informasjon, slik Chat GPT kan, og ei heller har den støtte for opplasting av filer og bilder.

Dette skal imidlertid komme på plass senere, lover selskapet.

Når det gjelder tilgjengelighet kan den nye modellen brukes av Chat GPT Plus- og Team-brukere allerede nå, der hvor man manuelt velger modell. Det er ennå begrensninger på antallet instrukser man kan gi per uke, men Open AI sier de jobber med øke antallet.

Flere modeller i den nye serien vil også komme etter hvert, men det foreligger ingen konkrete tidspunkter.

Powered by Labrador CMS