kunstig intelligens
Ny Chat GPT-konkurrent hevder å være den kraftigste KI-modellen på markedet
«Claude 3» kan bli den argeste konkurrenten til Open AIs snakkerobot.
Open AI med sin Chat GPT-teknologi har fremdeles et forsprang på KI-fronten, men konkurransen er nå i ferd med å tilspisse seg for alvor. Nå har en ny aktør entret arenaen, og den kan ha potensiale til å bli en av Chat GPTs aller argeste konkurrenter.
Selskapet Anthropic kunngjorde nylig den seneste utgaven av KI-modellen sin, døpt Claude 3 – som utvikleren hevder kan slå Open AIs mest avanserte modell GPT 4 på flere viktige områder.
Gjør det skarpt i de fleste målingene
Claude 3 lanseres som en «familie» bestående av tre varianter; Claude 3 Haiku, Claude 3 Sonnet og Claude 3 Opus, hvorav sistnevnte er den mest avanserte. De øvrige variantene er designet for høyere kostnadseffektivitet og raskere respons.
Ifølge Anthropic presterer Claude 3 Opus bedre enn samtlige konkurrenter i alle de vanligste målingsverktøyene for KI-systemer.
Oversikten som selskapet har lagt ut på nettsidene sine indikerer at Opus-modellen kommer bedre ut enn GPT 4 på blant annet MMLU-målingen («Massive Multitask Language Understanding»), et utbredt verktøy for testing av kunnskapen og problemløsningsegenskapene til KI-modeller.
På MMLU-målingen skårer Claude 3 Opus 86,8 prosent, som riktignok bare er et hakk foran GPT 4, som har et resultat på 86,4 prosent.
Ifølge oversikten kommer Opus-modellen også bedre ut i tre ulike matematiske målingsverktøyer, og vesentlig bedre ut i et ytelsesverktøy for koding, kalt HumanEval. Sistnevnte gir Claude 3 Opus et resultat på 84,9 prosent, mens GPT 4 kun får 67 prosent med dette verktøyet.
Bedre visuell forståelse
I flere av målingene slår Opus-modellen GPT 4 med svært knapp margin, for eksempel i de to kunnskapsmålingene ARC-Challenge og HellaSwag, hvor forskjellen er på marginale 0,1 prosent.
Utvikleren drister seg til å påstå at Claude 3 Opus presterer på «nært menneskelig nivå» når det gjelder en del kompliserte oppgaver, og at modellen representerer et viktig skritt mot såkalt AGI (artificial general intelligence).
Anthropic hevder også at de nye Claude-modellene har blitt oppgradert med vesentlig bedre prosessering av visuelle data, som bilder, grafer og diagrammer, og skal ligge på omtrent samme nivå som andre ledende modeller på dette området.
Modellene skal også by på betydelig mer nyansert forståelse av konteksten til forespørslene til brukerne, og på denne måten redusere problemet med at forespørsler avvises på bakgrunn av modellenes retningslinjer. Dette skal ifølge Anthropic ha vært et problem med de forrige Claude-modellene.
Claude 3 kan testes ut via tjenestens egen nettside, og for utviklere er en API er tilgjengelig for bruk i applikasjoner. API-en er tilgjengelig i 159 land, og Norge er inkludert på listen.