Nye språkmodeller fra Nasjonalbiblioteket skal styrke KI tilpasset norske forhold

Nasjonalbiblioteket har lansert de første språkmodellene på bokmål og nynorsk som er trent på opphavsrettsbeskyttet tekst fra norske aviser. Modellene er utviklet for å bidra til at kunstig intelligens som brukes i Norge, bygger på norske språk, norsk kultur og kunnskap om norske forhold. Med dette tar Norge en lederrolle i å gjøre språkmodeller fritt tilgjengelige etter trening på lisensiert opphavsrettsbeskyttet materiale.

Karianne Tung, Åse Wetås og Lubna Jaffery, fra lanseringen av språkmodellene på Nasjonalbiblioteket, mandag 10. august. Foto: Gorm K. Gaare / Nasjonalbiblioteket
Karianne Tung, Åse Wetås og Lubna Jaffery, fra lanseringen av språkmodellene på Nasjonalbiblioteket, mandag 10. august. Foto: Gorm K. Gaare / Nasjonalbiblioteket

Regjeringen har gitt Nasjonalbiblioteket i oppdrag å utvikle språkmodeller på bokmål, nynorsk og samiske språk. De nye modellene er de første resultatene av denne satsingen. Arbeidet med samiske språkmodeller pågår.

– Med Nasjonalbibliotekets språkmodeller får sykehusene våre, politiet og norske bedrifter et nytt og viktig verktøy for å utvikle og ta i bruk kunstig intelligens på norsk, der alle kjenner til hva de er trent på. Nå handler det om å omsette teknologien til bedre tjenester, økt produktivitet og nye løsninger i hele landet, sier digitaliserings- og forvaltningsminister Karianne Tung.

Regjeringen la tidligere i år til rette for at Nasjonalbiblioteket og Kopinor kunne inngå en avtale om bruk av avisinnhold i utviklingen av modellene. Denne sikrer at journalister og aviser får betalt for bruken av innholdet.

– Lanseringen av de nye språkmodellene er en milepæl i vår satsing på KI. Med disse språkmodellene, som er basert på norsk språk, kultur og samfunnsforhold, løftes kvaliteten og beredskapen samtidig som opphavsretten blir respektert, sier kultur- og likestillingsminister Lubna Jaffery.

– Kunstig intelligens preger stadig flere tjenester vi bruker i hverdagen. Derfor er det viktig at språkmodellene bygger på norske språk og kunnskap om norske forhold. Nasjonalbibliotekets omfattende samling av digitalisert norsk språk og kulturarv gir et unikt grunnlag for å utvikle åpne språkmodeller tilpasset norske behov, sier nasjonalbibliotekar Åse Wetås.

Bedre på moderne norsk

De nye modellene inngår i Borealis-serien, Nasjonalbibliotekets åpne språkmodeller. For første gang er opphavsrettsbeskyttet tekst fra norske aviser brukt i både grunntrening og fintrening av modellene på bokmål og nynorsk.

Tilgangen til opphavsrettsbeskyttet tekst gir modellene et bredere og mer oppdatert grunnlag i moderne norsk språk. Det bidrar dessuten til bedre ytelse i oppgaver som krever kjennskap til samfunnsforhold og referanser i dagens Norge.

En ny modell for utvikling av kunstig intelligens

Bruken av opphavsrettsbeskyttet innhold er regulert gjennom en kollektiv avtale mellom Nasjonalbiblioteket og Kopinor på vegne av norske aviser. Regjeringen har bevilget 45 millioner kroner årlig til avtalen, som sikrer kompensasjon til rettighetshaverne for bruk av innholdet.

Avtalen viser hvordan opphavsrettsbeskyttet innhold kan brukes i utviklingen av kunstig intelligens samtidig som rettighetshaverne kompenseres for bruken.

Så vidt Nasjonalbiblioteket kjenner til, er dette første gang en nasjon gjør egne språkmodeller, trent på lisensiert opphavsrettsbeskyttet materiale, fritt tilgjengelige.

Åpne modeller til fri bruk

Språkmodellene gjøres fritt tilgjengelige og kan tas i bruk av offentlig sektor, forskningsmiljøer og næringsliv.

Målet er å legge til rette for utvikling av tryggere og etisk forankrede KI-løsninger basert på norske språk og norske kilder, og å styrke grunnlaget for kunstig intelligens tilpasset norske forhold.

Fakta: De nye språkmodellene

  • Inngår i Borealis-serien, Nasjonalbibliotekets åpne språkmodeller.
  • Nye språkmodeller på bokmål og nynorsk.
  • Trente på norske språkressurser.
  • Opphavsrettsbeskyttet tekst fra norske aviser er brukt i både grunntrening og fintrening.
  • Rettighetshaverne kompenseres gjennom en kollektiv avtale mellom Nasjonalbiblioteket og Kopinor, på vegne av norske aviser.
  • Regjeringen har bevilget 45 millioner kroner årlig til avtalen.
  • Modellene gjøres fritt tilgjengelige.
  • Lanseringen er en del av regjeringens oppdrag til Nasjonalbiblioteket om å utvikle språkmodeller på bokmål, nynorsk og samiske språk.
Nasjonalbibliotekar Åse Wetås under lanseringen av språkmodellene på Nasjonalbiblioteket, 10. august. Foto: Gorm K. Gaare / Nasjonalbiblitoteket
Nasjonalbibliotekar Åse Wetås under lanseringen av språkmodellene på Nasjonalbiblioteket, 10. august.
Foto: Gorm K. Gaare / Nasjonalbiblitoteket
skolemagasinet-logo-v2

Få Skolemagasinet rett inn i din e-post kasse

Eldre utgaver.

SkoleMagasinet-1-2024-