forbrukerteknologi

Nå har Chat GPT blitt mye kraftigere – særlig for én type oppgave

Open AI gjør sin seneste modell GPT-4.1 tilgjengelig i Chat GPT for betalende brukere.

Open AI, her ved sjef Sam Altman, har nå i praksis gitt Chat GPT en kraftig oppgradering.
Open AI, her ved sjef Sam Altman, har nå i praksis gitt Chat GPT en kraftig oppgradering. Aurelien Morissard/AP/NTB

Det er alltid en relativt stor begivenhet når de store KI-aktørene lanserer nye modeller, og for nøyaktig en måned siden dro Open AI sløret av sin nye modellfamilie GPT-4.1 – som er kraftig forbedret på en rekke områder.

Nå følger Open AI opp med en kunngjøring om at GPT-4.1 omsider er blitt tilgjengelig for allmennheten via den populære Chat GPT-tjenesten. Hittil har den kun vært tilgjengelig for utviklere via API-en.

For betalende brukere

I første omgang er det kun betalende brukere som benytter seg av Plus-, Pro- og Team-tilbudene, som får tilgang til den nye modellfamilien, mens Enterprise-abonnenter får tilgang i løpet av de kommende ukene.

Brukere vil se den nye modellen under «flere modeller»-alternativet i menyen i Chat GPT-menyen.

Som Open AI peker på, er GPT-4.1 en spesialisert modell som er særlig sterk på koding og å følge detaljerte instrukser, og den skal være raskere i bruk enn de kraftige resonneringsmodellene OpenAI o3 og o4-mini, som også ble lansert nylig.

Når det gjelder koding, har GPT-4.1 blant annet blitt testet med SWE-bench, en krevende ytelsestest som brukes til å måle KI-modellers evne til å løse problemer i virkelige kodeprosjekter på Github.

I toppsjiktet

Modellen oppnådde et presisjonsnivå på 54,6 prosent – hele 21 prosent høyere enn GPT‑4o, hovedmodellen som har driftet Chat GPT hittil. Dette var med den såkalte «Verified»-utgaven av SWE-bench-testen, en «grundigere» versjon av testen som opererer med høyere kvalitetsstandarder.

Dette plasserer GPT-4.1-modellen i toppsjiktet når det gjelder kodeferdigheter, selv om det finnes flere modeller som ligger enda høyere.

– GPT‑4.1 er betydelig bedre enn GPT‑4o på en rekke kodeoppgaver, inkludert å agentisk løse kodeoppgaver, «frontend»-koding, gjøre færre unødvendige endringer, følge diff-formater pålitelig, sikre konsekvent verktøyanvendelse med mer, skrev Open AI.

Innen det som heter frontend-koding skal den nye modellen være i stand til å lage webapper som er mer funksjonelle og estetisk tiltalende enn tidligere modeller. Frontend-koding er prosessen med å bygge klientsiden av en nettside eller webapplikasjon — den delen som brukeren ser og samhandler med.

God på instrukser

GPT-4.1 skal altså også utmerke seg når det gjelder å følge instruksjoner. I en test som Open AI selv utviklet, inndelt i kategoriene enkel, middels og vanskelig, oppnådde modellen et presisjonsnivå på 49 prosent i det vanskelige kategorien – sammenlignet med kun 29 prosent for GPT-4o.

Open AI publiserte på onsdag også en evaluering av den nye modellen, som selskapet gjør hver gang nye modeller slippes. Evalueringen bruker Open AIs egne verktøy til å måle blant annet forekomsten av «hallusinasjoner», altså hvor ofte modellen «finner opp» opplysninger som ikke er sannferdige.

Her skal GPT 4.1 ha gjort det betydelig bedre enn GPT-4o, og faktisk bedre enn samtlige av selskapets øvrige modeller.

Mer informasjon om GPT-4.1 kan man finne i Open AIs egen beskrivelse.

Powered by Labrador CMS