kunstig intelligens
Anthropic legger vannmerker inn i KI-generert tekst
Gjør nye tiltak for merking av KI-innhold.
KI-genert innhold florerer på nettet og har blitt virkelig vanskelig å skille fra autentisk innhold.
Nå har Anthropic opplyst at de skal begynne med vannmerking av tekst generert av deres Claude-modeller. Nettstedet Axios er blant dem som har fanget opp saken.
Merkingen kommer hovedsakelig som en konsekvens av EUs nye reguleringer knyttet til KI-generert innhold. Alle nye modeller som lanseres etter 2. august, vil ha merkingen fra dag én, men Anthropic jobber også med å implementere den på tidligere modeller.
Merkingen gjelder globalt, altså også Norge.
Usynlig og vanskelig å bli kvitt
Tiltaket innebærer at tekst laget med Claude-verktøyene vil komme med usynlige vannmerker som kan maskinleses, og den vil ikke være enkel å «bli kvitt».
– Når en Claude-modell genererer tekst, vever den et umerkelig vannmerke direkte inn i selve teksten. Du vil ikke kunne se det, og det endrer ikke betydningen, kvaliteten eller lesbarheten til svaret fra Claude, forklarer Anthropic og fortsetter:
– Fordi vannmerket er en del av teksten, følger det med når teksten kopieres og limes inn andre steder, og det kan bestå gjennom enkelte former for redigering.
Merkingen gjelder også for filer som opprettes av Claude-modellene, i form av digitalt signerte metadata. Dersom disse signerte metadataene er til stede i filen, signaliserer dette at filen har blitt behandlet av Claude og hvorvidt den har blitt «fiklet med».
Den delen av arbeidet som imidlertid ikke er helt ferdig og avklart ennå, er selve avlesningen av vannmerkingen. Anthropic opplyser at de fremdeles jobber med å få på plass løsninger som setter vanlige brukere og tredjeparter i stand til å oppdage vannmerkene, og at mer informasjon om dette vil komme senere.
Har begrensninger
KI-giganten innrømmer at løsningen ennå har begrensninger. Vannmerkene signaliserer at innholdet ble behandlet av Claude, men ikke nødvendigvis at Claude var den opprinnelige skaperen av innholdet, påpeker Anthropic.
KI brukes som kjent ofte til korrekturlesing, oppsummeringer, oversettelser og lignende oppgaver med originaltekster som kommer fra andre steder.
Fravær av et vannmerke betyr heller ikke nødvendigvis at innholdet ikke ble KI-generert, for eksempel dersom innholdet ble generert med en modell som ble lansert før merkingen ble innført. I tillegg, dersom teksten har gjennomgått omfattende redigering eller er blandet sammen med annen tekst, kan vannmerkene være vanskelige å oppdage.
Med dette tar Anthropic trolig ledelsen innen merking av KI-innhold. Andre aktører har lignende tiltak på gang, men i en noe mer begrenset form. Google har utviklet en løsning kalt «SynthID», som også innebærer å bygge digitale vannmerker inn i KI-generert innhold.
Open AI kombinerer løsninger
Dette er en åpen teknologi som det er meningen at utviklere kan integrere i sine egne modeller, der Anthropics tilnærming altså er universell og proprietær
Open AI på sin side har også kastet seg på SynthID-teknologien. I slutten av julipubliserte selskapet en oppdatering hvor det kommer frem at de har valgt en kombinasjon av Googles teknologi og den såkalte C2PA-løsningen.
C2PA, som står for Coalition for Content Provenance and Authenticity (C2PA), er et initiativ som flere store teknologiaktører – inkludert Google selv, Meta, Microsoft og Open AI – har stilt seg bak. Organisasjonen jobber med åpne, tekniske standarder som innholdsskapere kan bruke til å etablere opprinnelsen til digitalt innhold.