Senest opdateret: 2026-09-15

AI-benchmark på dansk: dagens bedste modeller

Over 350 AI-modeller evalueres hver morgen — de bedste på dansk sprogkvalitet, hastighed og værdi præsenteres her.

Læs ugerapporter → Sammenlign modeller → ChatGPT vs Claude → Gemini vs ChatGPT →

Sådan læser du benchmarken

Benchmarken er lavet til praktiske valg, ikke kun rangering. Se først på din opgave, derefter på sprog, pris, fart og stabilitet.

Skal du skrive eller arbejde på dansk?

Start med sprog-score og hvilkenAI-score. Høj samlet score er nyttig, men sprogkvalitet bør veje tungest, når svaret skal publiceres eller sendes videre.

Skal du bruge AI ofte eller via API?

Se på pris per million tokens og værdi-score. En billigere model kan være bedst, når du kører mange opgaver eller bygger produkt.

Har du brug for hurtige svar?

Se på tokens per sekund og stabilitet. En hurtig model giver bedre flow i chat, kundeservice, automationer og værktøjer, hvor ventetid mærkes.

Bedst i sin klasse

🏆
Højeste score
OpenAI: o1
8.9/10
🇳🇴
Bedst på dansk
Claude Opus 5
10.0/10
Hurtigst
OpenAI: o1
534 t/s
💰
Billigst (score ≥ 3)
Meta: Llama 3.1 8B Instruct
$0.05/1M
📊
Bedste værdi
Meta: Llama 3.1 8B Instruct
Værdi 166.7
🔗
Bedste orkestrator
Meta: Llama 3.1 8B Instruct
Orch 10.0/10

Er premium prisen værd?

Premium dansk-score
9.7/10
Mid-range dansk-score
7.1/10
Prisforskel
~5×

Til dansk tekst og enkle opgaver rækker mid-range ofte langt. Premium betaler sig ved kompleks ræsonnering, lange dokumenter og når præcision er kritisk.

Alle resultater

# Model Niveau t/s TTFT dansk Instr Score Orch. Værdi EU Pris/1M
1
Meta: Llama 3.1 8B Instruct
meta-llama
Budget 274 47 ms 10.0 10.0 8.6 10.0 166.7 $0.05
≈0 kr
2
Claude Opus 5
anthropic
Premium 277 69 ms 10.0 9.3 8.9 9.3 1.9 🇪🇺 EU $5.00
≈32 kr
3
Amazon: Nova Premier 1.0
amazon
Stabil
Premium 189 70 ms 9.7 10.0 8.5 9.7 3.9 $2.50
≈16 kr
4
Perplexity: Sonar Pro Search
perplexity
Stabil
Premium 142 126 ms 9.7 10.0 8.5 9.7 3.3 ~EU $3.00
≈19 kr
5
Anthropic: Claude Haiku 4.5
anthropic
Stabil
Mid-range 124 115 ms 9.7 10.0 8.2 9.7 9.7 🇪🇺 EU $1.00
≈6 kr
6
OpenAI: o1
openai
Premium 534 29 ms 9.3 10.0 8.9 9.3 0.6 $15.00
≈97 kr
7
Amazon: Nova Lite 1.0
amazon
Stabil
Budget 179 75 ms 9.3 10.0 8.0 9.3 138.1 $0.06
≈0 kr
8
OpenAI: GPT-5.6 Terra
openai
Mid-range 166 111 ms 8.7 10.0 7.7 8.7 4.6 $2.00
≈13 kr
9
DeepSeek: DeepSeek V4 Flash 0731
deepseek
Budget 329 39 ms 8.0 8.0 6.8 6.4 133.3 $0.05
≈0 kr
10
Z.ai: GLM 5.1
z-ai
Mid-range 446 28 ms 7.3 7.3 6.3 5.4 7.5 $0.97
≈6 kr
11
Google: Gemini 2.5 Pro
google
Mid-range 433 54 ms 2.7 2.7 1.8 0.7 2.1 ~EU $1.25
≈8 kr
12
Qwen: Qwen3.5-Flash
qwen
Budget 1831 6 ms 1.3 0.7 0.9 0.1 12.5 $0.07
≈0 kr

Svartid de seneste 14 dage

Sådan tester vi

Vi evaluerer over 350 AI-modeller og præsenterer de bedste resultater hver morgen. Scoren kombinerer sprogforståelse, kvalitet, hastighed, pris og stabilitet. Den nøjagtige vægtning er proprietær.

Læs mere om metoden →

Ofte stillede spørgsmål

Vi evaluerer over 350 tilgængelige modeller og præsenterer de bedste resultater fra den seneste benchmark. Udvalget opdateres dynamisk, når markedet ændrer sig.

Sprog-scoren viser hvor godt modellen svarer på det rigtige sprog og med god sprogkvalitet. Scoren vises som et normaliseret tal.

Instruktions-scoren viser hvor godt modellen følger opgaven. Vi viser resultatet som en enkel, normaliseret score.

Scoren kombinerer sprogforståelse, kvalitet, hastighed, pris og stabilitet. Den nøjagtige vægtning er proprietær.

Bedste værdi peger på modeller, der giver stærke resultater i forhold til pris. Den nøjagtige beregning er proprietær.