kunstig intelligens
Studie viser at KI-modeller ikke er så kreative som vi tror
Forskere lot KI generere et stort antall bilder på egen hånd, med skuffende resultat.
Av de utallige oppgavene som KI allerede er i stand til å utføre, er rent kreativt arbeid også blant ferdighetene som moderne, generativ KI klarer overraskende bra – i alle fall tilsynelatende.
Nå foreligger det en studie som indikerer at generativ, kunstig intelligens ikke er så kreative som vi kanskje kan få inntrykk av, dersom man graver litt dypere ned under overflaten. Nettstedet Digital Camera World skrev om saken.
Testet visuelle KI-ferdigheter
En gruppe forskere bestemte seg for å teste hvor kreative moderne KI-systemer er når det gjelder å generere originale bilder på egen hånd, uten direkte, menneskelig innblanding.
Forskerne er tilknyttet Högskolan Dalarna i Sverige og Michigan State University i USA, og publiserte nylig resultatene i vitenskapsmagasinet Patterns.
Metodologien innebar i korte trekk å bruke to av de mest avanserte åpen kilde-modellene på markedet, hvorav den ene genererte bilder fra en instruks, mens den andre regenererte bildene basert på KI-modellens egen beskrivelse av bildene.
Forskerne benyttet over 700 startinstrukser som var spesifikt designet for å være så originale og unike som mulig, og KI-modellen ble bruk til å regenerere bildene 100 ganger i en «loop» uten menneskelig input.
Poenget var å finne ut i hvilken grad KI-modellen var i stand til å bevare den opprinnelige originaliteten til de 700 startinstruksene. Det man fant, var at modellene graviterte mot et fåtall, generiske kategorier av bilder, til tross for den store variasjonen i startinstrukser.
Laget «visuell heismusikk»
– Studien vår viser at når man kombinerer to frontmodeller; en som beskriver bilder og en som regenererer dem, og de samhandler uten menneskelig innblanding, beveger de seg mot et lite sett av høyst konvensjonelle, visuelle motiver, slik som fyrtårn, katedraler og palassaktige interiører, skriver forskerne.
Forskerne kaller de generiske bildene som KI-modellene skaper når de overlates til seg selv i en tilbakemeldingsloop, for «visuell heismusikk». Samtlige av de genererte bildene falt inn under kun 12 kategorier, ifølge forskerne.
Resultatene avslører en fundamental svakhet i den underliggende arkitekturen til KI-modellene, som består i at de baserer seg på statistisk analyse av mønstre, og ikke «ekte» kreativitet.
– De eksperimentelle bevisene viser at når generative modeller gjentar prosesser basert på egne resultater, utforsker de ikke hele handlingsrommet for kreative muligheter. I stedet samler de seg om et begrenset sett med 'høy-sannsynlighets-attraktorer'. Disse attraktorene produserer konsekvent generiske, kommersielt anvendelige bilder som mangler nyskapningen og overraskelsesmomentet man vanligvis forbinder med kreativ utforskning, kommenterer forskerne i konklusjonen.
– Viktig med menneskelig deltakelse
Forskerne mener funnene utfordrer ideen om at KI er i stand til ekte kreativitet på egen hånd, og at menneskelig innblanding derfor er nødvendig for å sikre kreativt mangfold.
Det pekes også på at funnene har større samfunnsmessige implikasjoner. Bruk av slike generative KI-modeller til kreativt arbeid i stor skala kan føre til en homogenisering av den visuelle kulturen, advarer forskerne, og dette er ekstra viktig å være klar over i lys av at KI-systemer i økende grad opererer autonomt.
Alle detaljene finner man i selve forskningsdokumentet i sin helhet.
KI-bruken øker kraftig også når det gjelder andre typer kreativ virksomhet, ikke minst video og musikk. Fenomenet har mange skeptikere, og som Digi har rapportert har mange etablerte musikere allerede signert et opprop mot det de oppfatter som en trussel mot menneskelig kreativitet.