kunstig intelligens
Kinesisk KI-teknologi gjør amerikanerne nervøse
Nå kommer Kina for alvor inn på KI-arenaen.
Kina og USA er store teknologikonkurrenter, men vi har ikke hørt så mye til de kinesiske bidragene på KI-fronten ennå. Dette ser imidlertid nå ut til å være i ferd med å endre seg i raskt tempo.
Som blant andre Wall Street Journal og CNBC rapporterer har et kinesisk KI-selskap raskt seilt opp som en farlig utfordrer til de etablerte, amerikanske aktørene. Selskapet heter «Deepseek».
Vekker oppsikt
Deepseek har bygget KI-teknologi som allerede har vakt oppsikt globalt. Nylig lanserte selskapet en spesialisert problemløsningsmodell, døpt «R1», og den har fått amerikanerne og Silicon Valley til å heve øyebrynene.
– Deepseek R1 er en av de mest fantastiske og imponerende gjennombruddene jeg noensinne har sett – og som åpen kildekode, en dyp gave til verden, skrev Marc Andreessen i en melding på X nylig.
Andreessen er en teknologientreprenør, tidligere programvareingeniør og storinvestor som blant annet var en av utviklerne bak nettleserne Mosaic og Netscape i sin tid. Han støtter også aktivt Donald Trump, som nylig avduket det ambisiøse KI-prosjektet Stargate.
Også den store KI-aktøren Microsoft har uttrykt beundring.
– Å se den nye Deepseek-modellen er utrolig imponerende både når det gjelder hvordan de har klart å lage en åpen kildekodemodell som utfører denne beregningen under inferenstiden, og som er svært beregningseffektiv. Vi bør ta utviklingen fra Kina veldig, veldig seriøst, kommenterte Microsoft-sjefen Satya Nadella på Verdens økonomiske forum i Sveits nylig, som rapportert av CNBC.
Gjør det skarpt i målinger
I tillegg til den spesialiserte R1-modellen lanserte Deepseek også sin seneste flaggskipmodell, en språkmodell kalt V3, i desember. I et teknisk dokument publisert på Github hevder selskapet at denne kun tok to måneder å bygge, til en pris på kun 6 millioner dollar.
V3-modellen opererer ifølge dokumentet med 671 milliarder parametere, et høyt tall for en åpen kilde-modell. Til sammenligning skilter for eksempel Metas modell Llama 3.1 med 405 milliarder parametere, og denne regnes blant de kraftigste åpen kilde-modellene på markedet for øyeblikket.
Deepseek har kjørt modellene sine gjennom de aller fleste av ytelsesmålingene for KI-modeller. Selskapet har lagt ut en oversikt på nettsidene sine hvor V3-modellen slår Llama 3.1 i mer eller mindre samtlige målinger. I tillegg slår V3 et par av de beste lukkede modellene, Anthropics Claude 3.5 og Open AIs GPT 4o, i flere av ytelsesmålingene.
Når det gjelder den nye, spesialiserte modellen R1, hevder Deepseek på Github at denne kan konkurrere med Open AI-modellen o1 i matematikk, koding og resonneringsoppgaver. o1 er altså Open AIs avanserte resonneringsmodell som har gjort det svært skarpt i matematikk og koding.