analyse

Den usensurerte Deepseek kan forandre verden

Gode og klimavennlige språkmodeller? Ja takk, begge deler.

Deepseek har rystet en hel verden med sine nye KI-modeller.
Deepseek har rystet en hel verden med sine nye KI-modeller.

De kinesiske forskerne i Deepseek har de siste dagene skapt sjokkbølger med sin nyeste språkmodell R1. Den skal visstnok matche Chat GPT o1 og andre språkmodeller på flere områder, med bare en brøkdel av ressursbruken: To måneders arbeid og 70 millioner kroner. Her er det riktignok stor usikkerhet knyttet til hva som er riktige tall.

Kort sagt bruker Deepseek en annen tilnærming til treningen av språkmodellene, som ikke lenger skal gjøre det nødvendig å støvsuge kloden vår for tekster, elektrisitet og KI-brikker. Det setter de andre KI-aktørenes enorme ressursbruk i et nesten pinlig lys.

Mange har med rette pekt på hvordan Deepseek sensurerer svarene sine i tråd med offisiell kinesisk politikk. Du kan spørre om Ole Brumm, fredsprisvinnere og Den himmelske freds plass, men Deepseek-appen nekter å snakke om det. Personvernreglene er dessuten minst like ille som på de amerikanske tjenestene.

Det er selvfølgelig dypt problematisk. Men på flere måter også et sidespor.

Åpen kildekode

Deepseek-modellene har blitt til ved hjelp av åpen kildekode fra blant annet Metas Llama-språkmodeller. De er blitt trent på en ny og tilsynelatende svært ressursbesparende måte. Og viktigst: Sluttproduktet blir delt tilbake til samfunnet som åpen kildekode, slik at hvem som helst kan bygge videre på den.

Faktisk er ikke sensuren fullt integrert i selve språkmodellen, mye er lagt utenpå. Derfor er mobilappen og de offisielle sidene hardt sensurert, men mye mindre hvis du laster ned språkmodellen til eget bruk. Det kan du teste selv ved å gå til Github-sidene, eller aller enklest - en tjeneste som LM Studio. Der finnes det ulike destillerte versjoner som virker på vanlige laptop-maskiner.

Ikke bare er språkmodellene åpen kildekode, du kan altså bruke dem helt offline på din egen datamaskin. Da deler du null data med Kina eller noen andre.

Alt dette betyr at Facebook, Google eller en hvilken som helst norsk startup kan videreutvikle språkmodellene selv. De kan få sine egne etiske rammer, bli spesialister innenfor nye områder eller tilpasset spesielle behov.

Alle kan bli med

Det bør være gode nyheter for den videre utviklingen av generativ kunstig intelligens, nå mer frigjort fra Open AI og de store aktørenes herredømme på feltet. Hvem som helst kan ta neste steg.

Det er formodentlig også bra for klimaet, hvis vi kan roe ned på utbyggingen av enorme datasentre og den vanvittige ressursbruken de bærer med seg.

Til sammenligning skulle det amerikanske Stargate-programmet etter planen bruke nærmere seks billioner kroner på datasentre og annen KI-infrastruktur. Nå har altså et kinesisk selskap vist verden at språkmodeller kan lages mye mer effektivt, uten å kaste absurde mengder datakraft på jobben.

Det spørs om ikke amerikanerne trenger en ny plan.

Spørsmålet er hva som nå skjer med de etiske sidene av KI-utviklingen. USA har allerede opphevet mange av restriksjonene og reguleringene fra Biden-administrasjonen, og nå vil presset ventelig øke på å framskynde den videre utviklingen av generativ kunstig intelligens. Følgene av en slik utvikling er vanskelig å forutse, ikke minst for oss i Europa som har en mer restriktiv holdning til personvern og KI-utvikling.

I første omgang har vi mer enn nok med å følge med på neste trekk.

Powered by Labrador CMS