forbrukerteknologi
Microsoft lanserer gratis tale-til-tekst på norsk
En språkbank fra Nasjonalbiblioteket gjorde at Microsoft kunne lansere sin talegjenkjenning på norsk før alle de andre nord-europeiske språkene.
Microsoft Word har i flere år hatt en «Dictate»-knapp i høyre hjørne, som i dag støtter engelsk, kinesisk, fransk, tysk, italiensk, spansk og portugisisk.
Nå i oktober kommer tjenesten også på norsk bokmål. Tjenesten, som er gratis, vil i første omgang kun komme i web-versjonen av Word. Deretter vil den integreres i Powerpoint, Onenote, Outlook, skrivebordsversjonen av Word, Microsoft Trends og Microsoft Teams. Det skal fungere både på PC og Mac, opplyser Microsoft Norge.
Det vil fortsatt ta noen få uker før alle brukerne får tjenesten på plass, opplyser Microsoft, etter digi.no ikke fant funksjonen da vi ønsket å teste den.
Støtter ikke opptak
Tale-til-tekst-funksjonen skal gjøre det mulig det mulig å transkribere lyd til tekst i sanntid. Tjenesten skal også fungere sømløst med oversettelse og tekst-til-tale, slik at man kan følge en presentasjon på et fremmed språk og få en oversettelse gjennom et headset i sanntid.
Det å laste opp en lydfil for så å spilles av med transkribering støttes foreløpig ikke. Tjenesten er foreløpig en generell motor som genererer norsk tale til tekst i sanntid. I løpet av et halvårs tid, vil den kunne transkribere videoer i for eksempel Stream, skriver Microsoft i en mail.
Først i Norden
Språkbanken i Nasjonalbiblioteket har gitt Microsoft fri tilgang til flere tusen timer med transkribert tale på norsk.
Dataene har trimmet Microsofts database og bidratt til å utvikle norsk tale-til-tekst mye raskere enn det ville vært mulig uten.
Lanseringen av diktering på norsk er den første i rekken av en plan for å lansere funksjonen på flere nordiske språk — svensk, finsk, dansk, nederlandsk, som alle etter planen skal være på plass i løpet av vinteren.
Microsoft Norge opplyser at samarbeidet med blant andre Nasjonalbiblioteket har vært utslagsgivende for at Norge er første land ut i Norden som får denne tjenesten.
– Det er ikke tilfeldig at norsk kommer først. Microsoft har samarbeidet tett med den norske regjeringen, Nasjonalbiblioteket og Språkrådet, sa Mike Tholfsen, produktsjef i Microsoft Education Corp, under lanseringen av tjenesten hos Microsoft Norge denne uken.
Lanseringen var en del av et dagsarrangement for lærere om IT-gigantens ulike verktøy for utdanningssektoren, med fokus på barn med lese- og skrivevansker.
Direktør i Språkrådet, Åse Vetås og Nasjonalbibliotekets Jon Arild Olsen var også tilstede, samt forsknings- og høyere utdanningsminister Iselin Nybø.
Nybø: – Kobler humanistisk kunnskap og IKT
– For å sikre at norsk språk forblir et bruks- og hovedspråk i norsk arbeidsliv, og i samfunnslivet i fremtiden, er det avgjørende at norsk språk integreres i den teknologiske utviklingen, sa Nybø.
Ifølge ministeren er tale til tekst-løsningen et godt eksempel på samarbeid mellom privat kapital og offentlige myndigheter, og vil komme til nytte i blant annet helsesektoren, næringsliv og kunnskapssektoren.
– Det å koble sammen IKT-løsningene til Microsoft og felleshukommelsen i Nasjonalbiblioteket, viser verdien av å binde sammen humanistisk kunnskap med IKT. For i en verden med raske teknologiskifter, er det nødvendig å forstå betydningen av ting som identitet, verdier, religion, kultur, etikk og språk, sa ministeren.
– For lite marked til at bedriftene kan utvikle dette alene
Både Google, Apple og norske aktører som Max Manus AS har levert løsninger for talegjenkjenning på norsk de siste årene. Men det har i stor grad dreid seg om spesialiserte tjenester for spesifikke målgrupper.
Dette påpeker seniorrådgiver Jon Arild Olsen ved Nasjonalbiblioteket. Han er koordinator for språkbanken som ble opprettet i 2010, og som har vært et viktig datagrunnlag for Microsofts nye talegjenkjenning på norsk.
– Det har vært tale til tekst-teknologi i bruk i Norge i flere år, men den har vært begrenset til rapportskriving i helsevesenet. Det vi ser nå er at fra å ha blitt brukt innenfor spesifikke sektorer og brukergrupper, så rulles det nå ut i tjenester som treffer befolkningen mye bredere. Dette er et stort skritt mot å gjøre norsk språk tilgjengelig i flest mulige digitale tjenester som brukes av folk flest, sa han under lanseringen hos Microsoft Norge denne uken.
Ifølge Olsen ble språkbanken opprettet nettopp for å tilby datasett som muliggjør tjenester som den Microsoft nå har lansert.
– Utvikling av språkteknologi krever store mengder data, til dels av veldig høy kvalitet, noe som tar mye tid og ressurser å utvikle. Og det norske markedet er generelt for lite til at du kan forvente at private selskaper utvikler slike ressurser selv. De kan tilpasse produkter for norsk, men ikke skape grunnlagsdataene for å gjøre dette fra bunnen av, sa Olsen.
Slår over til engelsk
En særlig utfordring for det norske språket i denne sammenhengen er at vi snakker godt engelsk, trakk seniorrådgiveren frem.
– Hvis vi ikke tilpasser de digitale tjenestene til norsk, tar vi de i bruk uansett, men da gjør vi det på engelsk. Fra et språkpolitisk ståsted er det derfor veldig viktig å sørge for at norsk språk er tilgjengelig i de mest brukte digitale språkteknologiske tjenester, sa Olsen.
– Det skal ikke være slik at du må slå over til engelsk fordi du har akutt senebetennelse, ikke kan bruke tastaturet, og skal levere en hjemmeeksamen om en uke. Du skal også kunne bruke norsk når du snakker med digitale assistenter på mobil eller i bil, utdypet Olsen.
Utvider datagrunnlaget med nye metoder
I dag tilbyr språkbanken om lag 50 forskjellige datasett, og tallet øker hvert eneste år. Og i år fikk Språkrådet og Nasjonalbiblioteket sammen en økt bevilgning fra Stortinget for å styrke og utvide disse datagrunnlagene.
En av de tingene pengene skal gå til er å transkribere opp mot 500 timer med stortingsforhandlinger, og gjøre det tilgjengelig for bedrifter som ønsker å bruke det.
– Stortinget gjør opptak av alle sine møter og legger det fritt ut. I motsetning til mange andre typer data er dette offentlig og fritt tilgjengelige data som fritt kan viderebrukes, sa Olsen.
Stortingsrepresentantene snakker et relativt variert språk, og bruker stort sett dialektene fra regionene de kommer fra. I tillegg til opptakene legger også Stortinget ut transkriberte referater av det som blir sagt i stortingssalen, fortalte Olsen.
Planen var derfor å parallellstille opptakene med referatene og bruke dette som treningsdata for talegjenkjenning. Problemet var bare at referatene tilrettelegges for å kunne leses som tekst, og derfor ikke alltid følger nøyaktig det som blir sagt.
– Når folk snakker er det mye nøling, kremting, de begynner på en setning og avslutter med en annen. Det er den typen støy som du må ha med i datagrunnlag som skal trene opp talegjenkjenning, påpeker Olsen.
Han forteller at de nå transkriberer opptakene fra Stortinget på nytt ved hjelp av en automatisk talegjenkjenningsløsning fra Google, for å få de så talenære som mulig.
– Resultatet har vært langt fra fullgodt, det er opp mot 25 prosent feil, men letter likevel arbeidsprosessen, sa Olsen.
Av andre nye prosjekter vil Nasjonalbiblioteket og Språkrådet også transkribere ordlister over de mest brukte ordene til de fem største norske dialektene, som i tillegg til østnorsk vil være Stavanger, en vestlandsdialekt, sannsynligvis fra Volda, en Trondheims-dialekt og en dialekt fra Nordland, sannsynligvis Bodø.