kunstig intelligens
Open AIs nye chatmodell skal føles enda mer menneskelig
Og du kan teste den allerede nå.
Som den kanskje viktigste aktøren på KI-feltet for øyeblikket er det alltid knyttet store forventninger til hva selskapet foretar seg, og nå har selskapet avduket en nyhet av det ganske store slaget.
På torsdag dro selskapet nemlig sløret av GPT-4.5, den kraftigste og beste chatmodellen de har lansert så langt.
Det nye med GPT-4.5 er at den skal føles enda mer naturlig enn GPT-4-modellen som Chat GPT hovedsakelig baserer seg på i dag.
Langt mer menneskelig
Ifølge Open AI opererer den nye modellen med enda større grad av «menneskelige» egenskaper som intuisjon, EQ (emosjonell intelligens), og kreativitet.
Disse egenskapene skal igjen gjøre modellen vesentlig bedre til oppgaver som skriving, programmering, praktisk problemløsning, og den skal oppleves som en «varmere» og mer naturlig samtalepartner som er bedre i stand til å forstå menneskelige behov og intensjoner.
Open AI skriver at tidlige tester av den nye modellen viser at brukere opplever den som nettopp mer naturlig å snakke med. I tillegg skal den også «hallusinere» i langt mindre grad enn før – som innebærer lavere forekomst av feil og unøyaktigheter.
Alt dette har selskapet oppnådd blant annet ved å oppskalere modellens evne til å lære uten direkte menneskelig tilsyn («unsupervised learning»), en sentral egenskap i utviklingen av mer sofistikerte modeller.
Denne oppskaleringen er muliggjort ved å heve nivået på både datakraften som brukes til treningen, selve datamengden og innovasjoner innen optimalisering og arkitektur, sier Open AI.
Skårer bra på faktaspørsmål
– Kombinasjonen av dyp forståelse av verden med forbedrede samarbeidsevner resulterer i en modell som integrerer ideer naturlig i varme og intuitive samtaler som er mer tilpasset menneskelig samarbeid, skriver Open AI og legger til:
– GPT-4.5 har en bedre forståelse av hva mennesker mener og tolker subtile hint eller implisitte forventninger med større nyanse og «EQ». GPT-4.5 viser også sterkere estetisk intuisjon og kreativitet. Den utmerker seg i å hjelpe med skriving og design.
Selskapet har kjørt modellen gjennom den såkalte SimpleQA-testen, som måler språkmodellers evne til å besvare vanskelige faktaspørsmål. Her skåret den 62 prosent, der GPT-4o kun skilter med et resultat på 38,2 prosent.
Til og med den kraftige «resonneringsmodellen» OpenAI o1 skåret kun 47 prosent i SimpleQA-testen.
Det er Chat GPT Pro-brukere som først får tilgang til GPT-4.5-modellen, men den skal rulles ut til Plus- og Team-brukere allerede neste uke. Deretter følger Enterprise- og Edu-brukere uken etter. Modellen har tilgang til den nyeste, oppdaterte informasjonen via søk-funksjonen, støtter opplasting av filer og bilder, og kan bruke kodefunksjonen Canvas.