Nasjonalbiblioteket har lansert de første språkmodellene på bokmål og nynorsk som er trent på opphavsrettsbeskyttet tekst fra norske aviser. Med dette tar Norge en lederrolle i å gjøre språkmodeller fritt tilgjengelige etter at de er trent på lisensiert opphavsrettsbeskyttet materiale.
Mandag 10. august lanserte Nasjonalbiblioteket nye språkmodeller som inngår i Borealis-serien, Nasjonalbibliotekets åpne språkmodeller. For første gang er opphavsrettsbeskyttet tekst fra norske aviser brukt til trening av modellene på bokmål og nynorsk.
En avtale mellom Nasjonalbiblioteket og Kopinor regulerer bruken av opphavsrettsbeskyttet innhold. Kopinor har inngått avtalen på vegne av Mediebedriftenes landsforening og norske aviser. Regjeringen har bevilget 45 millioner kroner i året til avtalen, som sikrer kompensasjon til rettighetshaverne for bruk av innholdet.
Modellene skal bidra til at kunstig intelligens som brukes i Norge, bygger på norske språk, norsk kultur og kunnskap om norske forhold. Tilgangen til opphavsrettsbeskyttet tekst gir modellene et bredere og mer oppdatert grunnlag.
Norge er nå et foregangsland i dette feltet, og får med rette en god del oppmerksomhet internasjonalt.
— Det er givende å se at den historiske avtalen Kopinor har inngått med Nasjonalbiblioteket på vegne av Mediebedriftenes landsforening bærer frukt. Norge er nå et foregangsland i dette feltet, og får med rette en god del oppmerksomhet internasjonalt. Jeg håper måten regjeringen og Nasjonalbiblioteket har gått fram for å sikre lovlig tilgang til opphavsrettsbeskyttet materiale vil være et eksempel til etterfølgelse for andre nasjonale KI-satsinger, sier administrerende direktør i Kopinor Hege Munch Gundersen.
Kultur- og likestillingsminister Lubna Jaffery og digitaliserings- og forvaltningsminister Karianne Tung deltok på lanseringen. Jaffery la vekt på at modellene ikke bare er banebrytende i Norge, men også i verden fordi ingen andre land har en lignende språkmodellsatsing basert på vederlagsavtaler med rettighetshaverne.
— For oss er det et viktig premiss i seg selv: Vi mener at den raske utviklingen innen KI ikke skal gå på bekostning av rettigheter til dem som produserer innhold som språkmodellene trenes på for å bli gode, sa kultur–og likestillingsminister Lubna Jaffery som også takket Kopinor og Mediebedriftenes Landsforening som stiller med opphavsrettsbeskyttet materiale.
Digitaliserings- og forvaltningsminister Karianne Tung kalte lanseringen «en sensasjon i Norge og en sensasjon i verden» og trakk fram betydningen av at språkmodellene trenes på opphavsrettsbeskyttet materiale der rettighetshaverne blir kompensert.
Nasjonalbibliotekar Åse Wetås framhevet at Norge med dette viser vei for en mer transparent, mer ansvarlig og sikrere utvikling av generative språkmodeller til fri bruk i både offentlig og privat sektor.
— Kunstig intelligens preger stadig flere tjenester vi bruker i hverdagen. Derfor er det viktig at språkmodellene bygger på norske språk og kunnskap om norske forhold. Nasjonalbibliotekets omfattende samling av digitalisert norsk språk og kulturarv gir et unikt grunnlag for å utvikle åpne språkmodeller tilpasset norske behov, sier nasjonalbibliotekar Åse Wetås.