Norske modeller

Oppdatert oversikt over sentrale norske LLM-spor per august 2026. Nasjonalbiblioteket AI Lab (NbAiLab) leder utviklingen med Borealis 2 (Mixture of Experts, 26B/4B aktive), Borealis-familien (270M–27B), NB-Whisper, norsk TTS og samisk språkteknologi. Over 248 modeller er publisert åpent på Hugging Face.

NORA.LLM

Norallm-miljøet viderefører åpne norske modeller og viste ny aktivitet våren 2026, blant annet rundt NorMistral 11B-varianter inkludert ny 11B-thinking reasoning-modell med GGUF-støtte.

Se NorMistral 11B-thinking (GGUF)

NbAiLab: nb-gpt-gemma4

NbAiLab har svært hyppige oppdateringer i 2026. Nyeste flaggskip er nb-gpt-gemma4-26B — en multimodal (bilde + tekst) instruksjonsmodell basert på Gemma 4-arkitekturen med Aurora SFT-trening.

Se nb-gpt-gemma4 26B

TranslateGemma og ASR

Norsk infrastruktur for språk-AI dekker ikke bare chatmodeller, men også oversetting og talegjenkjenning. TranslateGemma 4B gir høykvalitets bokmål ↔ nynorsk-oversettelse.

Se TranslateGemma 4B (nb/nn)

Borealis 2 26B-A4B (NbAiLab)

Neste generasjon Borealis — Mixture of Experts med 26B totale parametere og kun 4B aktive under inferens. Basert på Gemma 4, vidretrent på Aurora 2604-datasettet (47 mrd. ord). Multimodal (bilde + tekst), norsk-sentrisk assistent. Preview-versjon.

Se Borealis 2 26B-A4B

Borealis-familien

Komplett modellserie fra NbAiLab bygget på Gemma 3: 270M, 1B (tekst), 4B, 12B, 27B (multimodal). Tilgjengelig i GGUF, MLX og safetensors. Instruksjons-varianter og åpne base-modeller for norsk, nynorsk og samisk.

Se Borealis 27B

Viking (AI Sweden)

Flerspråklig nordisk modellserie fra AI Sweden med sterk norskstøtte. Flere størrelser fra 7B til 33B, åpent tilgjengelig for forskning og kommersielt bruk.

Se Viking-modeller

NorwAI (NTNU)

NorwAI fra NTNU tilbyr 7B og 45B-varianter i aktiv produksjonsdrift for forskning og nordisk bedriftsbruk.

Se NorwAI-modeller

NB-Whisper (NbAiLab)

Norsk talegjenkjenning i fem størrelser (39M–1.5B), trent på 20 000 timer norsk tale fra NRK, Stortinget og Nasjonalbiblioteket. CC BY 4.0-lisens — fri bruk også kommersielt.

Se NB-Whisper Large

hviske-v5-tiny (syv.ai)

263M dansk ASR-modell distillert fra 2.1B ensemble. 8× mindre enn læreren, men slår den på FTSpeech (7.15 WER). 320× sanntid på GPU, kjører i nettleser via WebGPU. Relevant for norsk pga. språknærhet.

Se hviske-v5-tiny

Borealis 2 — neste generasjon norsk LLM (21. august 2026)

Borealis 2 26B-A4B er den nyeste og mest avanserte norske språkmodellen, lansert av NbAiLab 21. august 2026. Den bruker Mixture of Experts (MoE)-arkitektur fra Google Gemma 4: 26 milliarder totale parametere, men kun 4 milliarder aktive per forward pass. Dette gir kvaliteten til en stor modell med hastigheten og ressursbruken til en liten.

Modellen er vidretrent på Aurora 2604-datasettet (47 milliarder ord, 51 % norsk bokmål, 23 % nynorsk) og instruksjonstrent med aurora-sft-2606. Den støtter multimodal input (bilde + tekst) og er optimalisert for norske assistentoppgaver: skriving, oppsummering, Q&A og skrivestilvurdering.

Last ned Borealis 2 26B-A4B →

Nasjonalbiblioteket AI Lab (NbAiLab)

NbAiLab er Norges nasjonale forskningslaboratorium for språkteknologi, drevet av Nasjonalbiblioteket med ca. 40 medarbeidere. Laben utvikler åpne norske språkmodeller, talegjenkjenning, talesyntese og datasett. Alt publiseres åpent på Hugging Face.

Nøkkeltall

Kopinor-avtalen

Nasjonalbiblioteket har inngått en unik avtale med Kopinor/MBL som gir lovlig tilgang til norsk pressemateriale for modelltrening — 6,4 milliarder ord fra norske aviser inngår i Aurora-datasettet. Unikt i verdenssammenheng.

Kontakt: ailab@nb.no | ai.nb.no | GitHub

Aurora-datasettet: 47 milliarder ord

Aurora 2604 er treningskorpuset bak Borealis-modellene, ferdigstilt april 2026. Språkfordelingen:

Kilder: HPLT 3.0, FineWeb-2, norske aviser (Kopinor/MBL), digitaliserte bøker, offentlige nettsider (Maalfrid), akademiske PDF-er, kode og Wikipedia.

Borealis-familien (Gemma 3): 270M–27B

Alle finnes i GGUF, MLX og safetensors. Full release (med Kopinor-data) og open-varianter (uten). Sikkerhetsmetoden «prompt baking» baker sikkerhetsinstruksjoner direkte inn i modellvektene via LoRA-distillering.

NbAiLab: tale, syntese og samisk

NB-Whisper (norsk ASR)

Norsk talegjenkjenning i 5 størrelser (39M–1.5B). Trent på 20 000 timer fra NRK, Stortinget og Nasjonalbiblioteket. CC BY 4.0 — fritt kommersielt bruk.

VoxCPM2 (norsk TTS)

2B-parameter talesyntese med norske mannlige og kvinnelige stemmer. Live demo på Hugging Face Spaces.

Samisk ASR

Nordsamisk og lulesamisk talegjenkjenning med NVIDIA NeMo Parakeet og Nemotron. Sanntids streaming-varianter.

Samisk TTS

salmon-f5-tts for nordsamisk tale. Viktig for bevaring og revitalisering av samiske språk.

Neste steg

Gå til Hva skjer nå for statusbilde, eller til Ressurser for kildelinker.