Dansk sprogmodel
Hvorfor danske modeller er sværere at lave, og om en dansk ChatGPT er relevant for jer.
Indhold
- Findes der en dansk ChatGPT og er AI god nok til dansk?
- Sådan virker en dansk sprogmodel i praksis
- Hvad betyder Gefion og danske projekter for jer
- Eksempel: Dansk sprogmodel hos en IT-ansvarlig i en mindre kommune
- Dansk sprogmodel er ikke det samme som ChatGPT eller bare mere data
- Ofte stillede spørgsmål om Dansk sprogmodel
Dansk sprogmodel er en sprogmodel trænet specifikt på dansk tekst, enten som en helt dansk model eller som en større model finjusteret til dansk. Formålet er bedre forståelse af danske nuancer, lovtekst, brancheord og navne, og større kontrol over data og driftsomkostninger end ved brug af udelukkende internationale modeller.
Findes der en dansk ChatGPT og er AI god nok til dansk?
Der findes flere danske initiativer, fx Danish Foundation Models, universitetsprojekter som SDU's Mimir og kommercielle varianter, nogle gange omtalt som "DanskGPT". De største internationale modeller (ChatGPT, Gemini mv.) klarer mange opgaver bedst, fordi de har langt mere træningsdata. Men danske modeller vinder på suverænitet: I kan selv styre data og priser, og ofte er de billigere at køre for rene danske opgaver.
Sådan virker en dansk sprogmodel i praksis
En dansk sprogmodel er trænet på dansk træningsdata: aviser, bøger, offentlige dokumenter, kundemails og lignende. Tokenisering betyder, at teksten bliver brudt op i små stykker; dansk har færre færdige eksempler i de store datasæt, så tokeniseringen kan blive dyrere og mindre effektiv. Resultatet er en model, der typisk forstår danske udtryk, bøjninger og forkortelser bedre end en international model, men den kan mangle viden eller sammenhænge, hvis den ikke har set nok data.
Tænk på det som en lokal butik kontra en kæde: den lokale kan have præcis det, I bruger, men kæden har oftest flere varer på hylderne. Den danske model hjælper, når I har danske fagsprog, fortrolige dokumenter eller krav om, at data ikke må forlade landet.
Hvad betyder Gefion og danske projekter for jer
Gefion‑supercomputeren og nationale Projekter sigter mod at give forskere og virksomheder regnekraft og adgang til dansk træningsdata. Det betyder, at flere danske modeller kan trænes eller finjusteres lokalt, uden at I skal sende følsomme dokumenter til udlandet. For en virksomhed betyder det lavere adgangsbarrierer til at få en model, der faktisk forstår interne begreber og regelværk.
Gefion og lignende initiativer er ingen trylleformular; I skal stadig sørge for ordentligt træningsdata og tid til afprøvning.
Eksempel: Dansk sprogmodel hos en IT-ansvarlig i en mindre kommune
En IT-ansvarlig i en mindre kommune stod tre uger før et digitaliseringsprojekt med en bunke: 120 PDF’er med lokal planlovgivning, en 2017-prisliste og en lang mailtråd om borgerspørgsmål. Hun ville bruge en sprogmodel til at opsummere og lave FAQ'er til borgerne, men var bekymret for, at personfølsomme oplysninger ville blive delt med en udenlandsk tjeneste. Kommunen prøvede først en international model, resultaterne var hurtige, men krævede at flere dokumenter blev uploadet til en ekstern tjeneste, og juridisk holdt man ikke helt af løsningen.
Så valgte hun en dansk model i en test: træning tog cirka tre dage på lokal infrastruktur, tre kolleger brugte i alt 18 timer på at forberede og rense træningsdata, og den første version måtte genuddannes, fordi modelen blandede lokale vejnavne sammen. Det virkede ikke perfekt første gang, men gav en privat løsning, hvor data blev i kommunen, og fagudtryk blev genkendt bedre. Prisen var tid og intern koordinering, ikke mindst fordi der manglede klar vejledning til dataforberedelse.
Dansk sprogmodel er ikke det samme som ChatGPT eller bare mere data
En dansk sprogmodel er ikke automatisk lige så stor eller dygtig som ChatGPT. ChatGPT er en færdig, generel tjeneste; en dansk model kan være mindre, mere specialiseret og selvhostet. Træningsdata er ikke synonymt med kvalitet: meget data af lav kvalitet giver ikke nødvendigvis en bedre model. Tokenisering er kun et teknisk skridt, men det påvirker både pris og præcision for dansk tekst.
Hvad I vælger, afhænger af krav til kvalitet, fortrolighed og pris. En dansk model kan give jer bedre begrebsforståelse og kontrol, men forvent ekstra arbejde med data, test og løbende drift.
Vil I arbejde videre med dansk sprogmodel på jeres egne opgaver, er det dét, en AI-workshop går ud på. Skal I beslutte, hvor meget dansk sprogmodel må fylde hos jer, er det den slags valg, AI-rådgivning handler om.
Ofte stillede spørgsmål om Dansk sprogmodel
Findes der en dansk ChatGPT?
Der findes danske modeller og projekter, nogle omtales som DanskGPT, men de største generelle modeller som ChatGPT har stadig flest data og ofte bedre ydeevne. En dansk variant kan dog give bedre forståelse af lokale termer og større data‑kontrol.
Er en dansk sprogmodel bedre til dansk end ChatGPT?
Ikke altid. Danske modeller forstår danske nuancer bedre, især brancheord og navne, men internationale modeller præsterer ofte bedre på generelle opgaver på grund af større træningsdata. Valget afhænger af jeres behov for præcision versus bred viden.
Koster en dansk sprogmodel mere at få i drift?
Omkostningerne varierer. Træning og forberedelse af dansk træningsdata koster tid og ressourcer, men drift kan blive billigere, især hvis I undgår løbende betaling til en udenlandsk tjeneste. Regn med ekstra projektledelse og datarensning i starten.
Kan vi bruge en dansk sprogmodel uden udviklere?
I kan bruge færdige danske modeller uden dyb udvikling, men for at få dem til at forstå virksomhedens dokumenter og workflows kræves ofte nogen teknisk hjælp. Mange løsninger leveres med support, men planlæg tid til data‑forberedelse og test.

AI-rådgiver og underviser, grundlægger af AI Hero i Herning. Har bygget digitalt i over 20 år og hjælper danske virksomheder med at få AI i drift. Læs mere om Brian.