NORA.LLM
Norallm-miljøet viderefører åpne norske modeller og viste ny aktivitet våren 2026, blant annet rundt NorMistral 11B-varianter inkludert ny 11B-thinking reasoning-modell med GGUF-støtte.
Oppdatert oversikt over sentrale norske LLM-spor per august 2026. Nasjonalbiblioteket AI Lab (NbAiLab) leder utviklingen med Borealis 2 (Mixture of Experts, 26B/4B aktive), Borealis-familien (270M–27B), NB-Whisper, norsk TTS og samisk språkteknologi. Over 248 modeller er publisert åpent på Hugging Face.
Norallm-miljøet viderefører åpne norske modeller og viste ny aktivitet våren 2026, blant annet rundt NorMistral 11B-varianter inkludert ny 11B-thinking reasoning-modell med GGUF-støtte.
NbAiLab har svært hyppige oppdateringer i 2026. Nyeste flaggskip er nb-gpt-gemma4-26B — en multimodal (bilde + tekst) instruksjonsmodell basert på Gemma 4-arkitekturen med Aurora SFT-trening.
Norsk infrastruktur for språk-AI dekker ikke bare chatmodeller, men også oversetting og talegjenkjenning. TranslateGemma 4B gir høykvalitets bokmål ↔ nynorsk-oversettelse.
Neste generasjon Borealis — Mixture of Experts med 26B totale parametere og kun 4B aktive under inferens. Basert på Gemma 4, vidretrent på Aurora 2604-datasettet (47 mrd. ord). Multimodal (bilde + tekst), norsk-sentrisk assistent. Preview-versjon.
Komplett modellserie fra NbAiLab bygget på Gemma 3: 270M, 1B (tekst), 4B, 12B, 27B (multimodal). Tilgjengelig i GGUF, MLX og safetensors. Instruksjons-varianter og åpne base-modeller for norsk, nynorsk og samisk.
Flerspråklig nordisk modellserie fra AI Sweden med sterk norskstøtte. Flere størrelser fra 7B til 33B, åpent tilgjengelig for forskning og kommersielt bruk.
NorwAI fra NTNU tilbyr 7B og 45B-varianter i aktiv produksjonsdrift for forskning og nordisk bedriftsbruk.
Norsk talegjenkjenning i fem størrelser (39M–1.5B), trent på 20 000 timer norsk tale fra NRK, Stortinget og Nasjonalbiblioteket. CC BY 4.0-lisens — fri bruk også kommersielt.
263M dansk ASR-modell distillert fra 2.1B ensemble. 8× mindre enn læreren, men slår den på FTSpeech (7.15 WER). 320× sanntid på GPU, kjører i nettleser via WebGPU. Relevant for norsk pga. språknærhet.
Borealis 2 26B-A4B er den nyeste og mest avanserte norske språkmodellen, lansert av NbAiLab 21. august 2026. Den bruker Mixture of Experts (MoE)-arkitektur fra Google Gemma 4: 26 milliarder totale parametere, men kun 4 milliarder aktive per forward pass. Dette gir kvaliteten til en stor modell med hastigheten og ressursbruken til en liten.
Modellen er vidretrent på Aurora 2604-datasettet (47 milliarder ord, 51 % norsk bokmål, 23 % nynorsk) og instruksjonstrent med aurora-sft-2606. Den støtter multimodal input (bilde + tekst) og er optimalisert for norske assistentoppgaver: skriving, oppsummering, Q&A og skrivestilvurdering.
NbAiLab er Norges nasjonale forskningslaboratorium for språkteknologi, drevet av Nasjonalbiblioteket med ca. 40 medarbeidere. Laben utvikler åpne norske språkmodeller, talegjenkjenning, talesyntese og datasett. Alt publiseres åpent på Hugging Face.
Nasjonalbiblioteket har inngått en unik avtale med Kopinor/MBL som gir lovlig tilgang til norsk pressemateriale for modelltrening — 6,4 milliarder ord fra norske aviser inngår i Aurora-datasettet. Unikt i verdenssammenheng.
Kontakt: ailab@nb.no | ai.nb.no | GitHub
Aurora 2604 er treningskorpuset bak Borealis-modellene, ferdigstilt april 2026. Språkfordelingen:
Kilder: HPLT 3.0, FineWeb-2, norske aviser (Kopinor/MBL), digitaliserte bøker, offentlige nettsider (Maalfrid), akademiske PDF-er, kode og Wikipedia.
Alle finnes i GGUF, MLX og safetensors. Full release (med Kopinor-data) og open-varianter (uten). Sikkerhetsmetoden «prompt baking» baker sikkerhetsinstruksjoner direkte inn i modellvektene via LoRA-distillering.
Norsk talegjenkjenning i 5 størrelser (39M–1.5B). Trent på 20 000 timer fra NRK, Stortinget og Nasjonalbiblioteket. CC BY 4.0 — fritt kommersielt bruk.
2B-parameter talesyntese med norske mannlige og kvinnelige stemmer. Live demo på Hugging Face Spaces.
Nordsamisk og lulesamisk talegjenkjenning med NVIDIA NeMo Parakeet og Nemotron. Sanntids streaming-varianter.
salmon-f5-tts for nordsamisk tale. Viktig for bevaring og revitalisering av samiske språk.
Gå til Hva skjer nå for statusbilde, eller til Ressurser for kildelinker.