Spring til hovedindhold

AI-benchmarks

AI-modeller sammenlignet på kvalitet og pris.

Et praktisk overblik over offentliggjorte modelscorer, der hjælper dig med at sammenligne evner, styrker pr. kategori og driftsomkostninger uden at miste detaljerne.

Udforsk ranglistenBenchmarkkilde Seneste valgte udgivelse · 25. jun. 2026

Seneste opdateringer af benchmarks og modeller

Ranglisten på denne side er LiveBench-udgivelsen fra 25. juni, hentet igen den 22. september 2026. Den indeholder nu Grok 4.7 xHigh og DeepSeek V4.1 Flash Max Effort. Modelnoterne nedenfor er fra leverandørernes egne sider og markeret som sådan.

Grok 4.6

Samme API-pris på $2 / $6 som Grok 4.5. xAI rapporterer en Artificial Analysis Intelligence Index på 61 – på niveau med GPT-5.6 Sol Max, ét point efter Fable 5 Max. Stærk i evalueringer af vidensarbejde; 26 % på Terminal-Bench v3.

Læs briefingen om Grok 4.6

DeepSeek V4.1 Flash

DeepSeek V4.1 Flash erstattede V4 Flash den 10. sep. 2026 under det nye API-id deepseek-flash, til $0.15 / $0.60 pr. 1M tokens uden for spidsbelastning og $0.30 / $1.20 i spidsbelastning. Fra den 14. sep. sendes V4 Pro-forespørgsler også dertil, så skift model-id nu. LiveBench giver nu V4.1 Flash Max Effort 81.1 samlet.

Se den i modeltrackeren

Rækkerne i ranglisten kommer kun fra offentliggjorte LiveBench-data. Vi opfinder ikke scorer.

Best overall

Claude Fable 5.1 Max Effort leads this snapshot at 83.4 overall, $1.212 per successful task.

Best value per task

ox-alpha-max runs at $0.000 per successful task and still scores 69.2 overall.

Best open weights

DeepSeek V4.1 Flash Max Effort is the strongest open-weight model here at 81.1 overall — the option you can host yourself.

Best per capability

If your work is mostly one kind of task, these lead their category in this snapshot.

Ræsonnement
GPT-6 Astra Max Effort 92.7
Kodning
Claude 5.5 Opus Thinking Max Effort 89.3
Agentbaseret kodning
DeepSeek V4.1 Flash Max Effort 77.3
Matematik
Claude 5.5 Opus Thinking Max Effort 97.1
Dataanalyse
GPT-6 Astra Max Effort 83.0
Sprog
Claude Fable 5 Max Effort 90.7
Følge instruktioner
Gemini 3.8 Flash High 81.4

Every number above comes from the 2026-06-25 release dated 2026-06-25, published by a third-party benchmark and reproduced unaltered.

Feltets form i to billeder.

Det første diagram svarer på, “hvem der er stærkest”. Det andet svarer på det spørgsmål, der faktisk koster dig penge: hvilke af dem er værd at betale for.

Sådan rangerer de

Længere er bedre. Søjlerne viser Samlet-scoren ud af 100; tallet ved hver søjle er den præcise værdi. Vælg en række for at tage den model med i prisdiagrammet nedenfor.

Viser de øverste 12 af 58. Skift til den fulde sammenligning for at se alle modeller.

Kvalitet vs. pris

Op er stærkere, venstre er billigere – så de bedste køb ligger øverst til venstre. Nummererede punkter er værdifronten: intet billigere scorer højere. Grå punkter er slået på både score og pris.

606570758085900,024 US$0,050 US$0,100 US$0,200 US$0,500 US$1,00 US$1,439 US$1234567Claude Fable 5.1 Max Effort83.4 · 1,212 US$Pris pr. vellykket opgave (logaritmisk skala – hvert trin er en multiplikation, ikke en addition)Samlet

Valgt

Claude Fable 5.1 Max Effort

Anthropic

Samlet
83.4
pr. vellykket opgave
1,212 US$

#7 · På værdifronten.

Bedste køb (billigste → stærkeste)

  • Bedste værdi til prisen
  • Slået på både score og pris

Hold musen over eller tryk på et nummereret punkt (eller dets række til højre) for at læse den præcise score og pris. Piletasterne går gennem modellerne fra billigste til dyreste.

Læs de samme 57 tal som en tabel
Kvalitet vs. pris
ModelOrganisationSamletpr. vellykket opgave
Claude Fable 5.1 Max Effort#7 · Bedste værdi til prisenAnthropic83.41,212 US$
Claude 5.5 Opus Thinking Max Effort#6 · Bedste værdi til prisenAnthropic83.20,799 US$
Claude Fable 5 Max EffortAnthropic83.01,439 US$
GPT-6 Astra Max Effort#5 · Bedste værdi til prisenOpenAI82.20,736 US$
GPT-6.1 Sol Max Effort#4 · Bedste værdi til prisenOpenAI81.60,142 US$
Muse Spark 1.3 xHigh EffortMeta81.60,219 US$
DeepSeek V4.1 Flash Max Effort#3 · Bedste værdi til prisenDeepSeek81.10,029 US$
GPT-5.6 Sol Max EffortOpenAI81.00,515 US$
GPT-5.5 Thinking xHigh EffortOpenAI80.20,435 US$
Claude 5 Opus Thinking Max EffortAnthropic80.10,699 US$
GPT-6 Sol Max EffortOpenAI79.30,268 US$
Kimi K3Moonshot AI79.20,348 US$
Gemini 3.7 Flash HighGoogle78.80,157 US$
Qwen 3.8 MaxAlibaba78.50,275 US$
Grok 4.6 xHighxAI78.00,207 US$
Muse Spark 1.2 xHigh EffortMeta78.00,375 US$
GPT-5.4 Thinking xHigh EffortOpenAI78.00,387 US$
GPT-5.6 Terra Max EffortOpenAI77.90,352 US$
Claude Sonnet 5.5 xHigh EffortAnthropic77.80,141 US$
DeepSeek V4 Pro 0813DeepSeek77.40,044 US$
Grok 4.7 xHighxAI77.40,718 US$
Gemini 3.1 Pro Preview HighGoogle77.00,286 US$
DeepSeek V4 Flash Vision ExpDeepSeek76.80,051 US$
Claude 4.7 Opus Thinking xHigh EffortAnthropic76.50,528 US$
Qwen 3.8 Flash NextAlibaba76.20,042 US$
Claude 4.8 Opus Thinking Max EffortAnthropic76.20,983 US$
GLM-5.3Z.AI76.10,450 US$
Claude Sonnet 5 xHigh EffortAnthropic76.00,505 US$
Grok 4.5xAI75.80,131 US$
Gemini 3.8 Flash HighGoogle75.80,307 US$
Qwen3.8 27BAlibaba75.30,094 US$
Muse Spark 1.1 xHigh EffortMeta75.30,198 US$
GPT-5.2 HighOpenAI74.60,234 US$
Gemini 3.5 Flash HighGoogle74.60,249 US$
Claude 4.6 Opus Thinking High EffortAnthropic74.50,404 US$
DeepSeek V4 Flash 0731DeepSeek74.20,060 US$
GPT-5.2 CodexOpenAI74.00,187 US$
GPT-5.6 Luna Max EffortOpenAI73.60,169 US$
Gemini 3.6 Flash HighGoogle73.60,235 US$
GLM-5.2Z.AI73.20,225 US$
Qwen 3.7 MaxAlibaba73.10,182 US$
Claude 4.6 Sonnet Thinking Medium EffortAnthropic73.00,306 US$
Claude 4.5 Opus Thinking High EffortAnthropic72.60,610 US$
GPT-6 Luna Max Effort#2 · Bedste værdi til prisenOpenAI72.00,026 US$
Inkling xHigh EffortThinking Machines71.90,310 US$
GLM-5.3 FlashZ.AI71.60,031 US$
Kimi K2.6 ThinkingMoonshot AI70.50,169 US$
GPT-5.4 Nano xHighOpenAI69.60,091 US$
Qwen 3.6 PlusAlibaba68.90,227 US$
Kimi K2.7 CodeMoonshot AI68.40,100 US$
Grok Build 0.1#1 · Bedste værdi til prisenxAI67.80,024 US$
Nemotron 3 Ultra 550B A55BNVIDIA67.40,371 US$
Minimax M3Minimax67.30,060 US$
GPT-5.4 Mini xHighOpenAI66.40,334 US$
Qwen 3.6 27BAlibaba64.00,202 US$
Gemini 3.5 Flash-Lite HighGoogle63.90,069 US$
Grok 4.3xAI62.30,061 US$

Kategoriprofil

Vælg op til tre modeller fra ranglisten for at sammenligne deres syv kategoriscorer.

  • Claude Fable 5.1 Max Effort83.4
  • ox-alpha-max69.2
  • DeepSeek V4.1 Flash Max Effort81.1
  • Ræsonnement91.776.686.7
  • Kodning86.475.880.0
  • Agentbaseret kodning66.152.677.3
  • Matematik97.077.593.3
  • Dataanalyse80.375.879.3
  • Sprog89.566.181.2
  • Følge instruktioner73.060.370.0

Hver skala går fra 0 til 100. Længere til højre er stærkere; det fede tal er førende i den række.

Læs disse scorer som en tabel
Kategoriprofil
KategoriClaude Fable 5.1 Max Effortox-alpha-maxDeepSeek V4.1 Flash Max Effort
Ræsonnement91.776.686.7
Kodning86.475.880.0
Agentbaseret kodning66.152.677.3
Matematik97.077.593.3
Dataanalyse80.375.879.3
Sprog89.566.181.2
Følge instruktioner73.060.370.0

Rangliste

Sortér hver kategori, indsnævr listen, og åbn en model for at se dens offentliggjorte fordeling på delopgaver.

  1. 01

    Claude Fable 5.1 Max Effort

    Anthropic

    83.4

    Samlet

    1,212 US$

    pr. vellykket opgave

    Matematik97.0Ræsonnement91.7Sprog89.5
  2. 02

    Claude 5.5 Opus Thinking Max Effort

    Anthropic

    83.2

    Samlet

    0,799 US$

    pr. vellykket opgave

    Matematik97.1Ræsonnement92.2Kodning89.3
  3. 03

    Claude Fable 5 Max Effort

    Anthropic

    83.0

    Samlet

    1,439 US$

    pr. vellykket opgave

    Matematik96.0Sprog90.7Ræsonnement89.7
  4. 04

    GPT-6 Astra Max Effort

    OpenAI

    82.2

    Samlet

    0,736 US$

    pr. vellykket opgave

    Matematik96.8Ræsonnement92.7Sprog89.4
  5. 05

    GPT-6.1 Sol Max Effort

    OpenAI

    81.6

    Samlet

    0,142 US$

    pr. vellykket opgave

    Matematik96.8Ræsonnement92.6Sprog90.1
  6. 06

    Muse Spark 1.3 xHigh Effort

    Meta

    81.6

    Samlet

    0,219 US$

    pr. vellykket opgave

    Matematik95.9Ræsonnement89.7Sprog82.8
  7. 07

    DeepSeek V4.1 Flash Max Effort

    åben

    DeepSeek

    81.1

    Samlet

    0,029 US$

    pr. vellykket opgave

    Matematik93.3Ræsonnement86.7Sprog81.2
  8. 08

    GPT-5.6 Sol Max Effort

    OpenAI

    81.0

    Samlet

    0,515 US$

    pr. vellykket opgave

    Matematik96.2Ræsonnement91.7Sprog87.7
  9. 09

    GPT-5.5 Thinking xHigh Effort

    OpenAI

    80.2

    Samlet

    0,435 US$

    pr. vellykket opgave

    Matematik95.9Ræsonnement89.7Sprog87.4
  10. 10

    Claude 5 Opus Thinking Max Effort

    Anthropic

    80.1

    Samlet

    0,699 US$

    pr. vellykket opgave

    Matematik95.7Ræsonnement91.2Sprog88.7
  11. 11

    GPT-6 Sol Max Effort

    OpenAI

    79.3

    Samlet

    0,268 US$

    pr. vellykket opgave

    Matematik96.4Ræsonnement88.7Sprog85.3
  12. 12

    Kimi K3

    åben

    Moonshot AI

    79.2

    Samlet

    0,348 US$

    pr. vellykket opgave

    Ræsonnement90.7Sprog85.5Matematik84.4
  13. 13

    Gemini 3.7 Flash High

    Google

    78.8

    Samlet

    0,157 US$

    pr. vellykket opgave

    Matematik93.5Ræsonnement87.8Sprog85.5
  14. 14

    Qwen 3.8 Max

    åben

    Alibaba

    78.5

    Samlet

    0,275 US$

    pr. vellykket opgave

    Matematik91.3Ræsonnement88.2Sprog79.7
  15. 15

    Muse Spark 1.2 xHigh Effort

    Meta

    78.0

    Samlet

    0,375 US$

    pr. vellykket opgave

    Matematik91.2Ræsonnement90.0Sprog78.6
  16. 16

    Grok 4.6 xHigh

    xAI

    78.0

    Samlet

    0,207 US$

    pr. vellykket opgave

    Matematik92.6Ræsonnement90.5Sprog83.7
  17. 17

    GPT-5.4 Thinking xHigh Effort

    OpenAI

    78.0

    Samlet

    0,387 US$

    pr. vellykket opgave

    Matematik94.1Ræsonnement88.1Sprog82.6
  18. 18

    GPT-5.6 Terra Max Effort

    OpenAI

    77.9

    Samlet

    0,352 US$

    pr. vellykket opgave

    Matematik94.9Ræsonnement90.6Sprog82.9
  19. 19

    Claude Sonnet 5.5 xHigh Effort

    Anthropic

    77.8

    Samlet

    0,141 US$

    pr. vellykket opgave

    Matematik96.7Kodning88.9Ræsonnement86.8
  20. 20

    DeepSeek V4 Pro 0813

    åben

    DeepSeek

    77.4

    Samlet

    0,044 US$

    pr. vellykket opgave

    Matematik95.1Ræsonnement85.8Sprog82.1
  21. 21

    Grok 4.7 xHigh

    xAI

    77.4

    Samlet

    0,718 US$

    pr. vellykket opgave

    Matematik95.7Ræsonnement82.7Sprog80.1
  22. 22

    Gemini 3.1 Pro Preview High

    Google

    77.0

    Samlet

    0,286 US$

    pr. vellykket opgave

    Matematik91.0Sprog85.4Ræsonnement84.0
  23. 23

    DeepSeek V4 Flash Vision Exp

    åben

    DeepSeek

    76.8

    Samlet

    0,051 US$

    pr. vellykket opgave

    Matematik87.8Ræsonnement85.4Sprog80.4
  24. 24

    Claude 4.7 Opus Thinking xHigh Effort

    Anthropic

    76.5

    Samlet

    0,528 US$

    pr. vellykket opgave

    Matematik92.9Ræsonnement87.2Kodning82.1
  25. 25

    Claude 4.8 Opus Thinking Max Effort

    Anthropic

    76.2

    Samlet

    0,983 US$

    pr. vellykket opgave

    Matematik94.3Ræsonnement89.2Kodning81.8
  26. 26

    Qwen 3.8 Flash Next

    åben

    Alibaba

    76.2

    Samlet

    0,042 US$

    pr. vellykket opgave

    Ræsonnement87.4Matematik85.8Følge instruktioner77.1
  27. 27

    GLM-5.3

    åben

    Z.AI

    76.1

    Samlet

    0,450 US$

    pr. vellykket opgave

    Matematik87.9Ræsonnement85.8Sprog79.9
  28. 28

    Claude Sonnet 5 xHigh Effort

    Anthropic

    76.0

    Samlet

    0,505 US$

    pr. vellykket opgave

    Matematik92.9Ræsonnement88.7Kodning80.7
  29. 29

    Grok 4.5

    xAI

    75.8

    Samlet

    0,131 US$

    pr. vellykket opgave

    Matematik90.8Ræsonnement87.2Sprog82.8
  30. 30

    Gemini 3.8 Flash High

    Google

    75.8

    Samlet

    0,307 US$

    pr. vellykket opgave

    Matematik91.6Ræsonnement89.3Sprog87.8
  31. 31

    Qwen3.8 27B

    åben

    Alibaba

    75.3

    Samlet

    0,094 US$

    pr. vellykket opgave

    Matematik86.2Ræsonnement80.0Dataanalyse76.6
  32. 32

    Muse Spark 1.1 xHigh Effort

    Meta

    75.3

    Samlet

    0,198 US$

    pr. vellykket opgave

    Ræsonnement87.7Matematik87.1Kodning77.2
  33. 33

    GPT-5.2 High

    OpenAI

    74.6

    Samlet

    0,234 US$

    pr. vellykket opgave

    Matematik93.2Ræsonnement83.2Sprog79.8
  34. 34

    Gemini 3.5 Flash High

    Google

    74.6

    Samlet

    0,249 US$

    pr. vellykket opgave

    Matematik88.2Sprog84.6Ræsonnement82.0
  35. 35

    Claude 4.6 Opus Thinking High Effort

    Anthropic

    74.5

    Samlet

    0,404 US$

    pr. vellykket opgave

    Matematik89.3Ræsonnement88.7Sprog83.3
  36. 36

    DeepSeek V4 Flash 0731

    åben

    DeepSeek

    74.2

    Samlet

    0,060 US$

    pr. vellykket opgave

    Matematik86.8Ræsonnement86.6Dataanalyse79.3
  37. 37

    GPT-5.2 Codex

    OpenAI

    74.0

    Samlet

    0,187 US$

    pr. vellykket opgave

    Matematik88.8Kodning83.6Dataanalyse78.2
  38. 38

    GPT-5.6 Luna Max Effort

    OpenAI

    73.6

    Samlet

    0,169 US$

    pr. vellykket opgave

    Matematik87.2Ræsonnement85.6Kodning82.9
  39. 39

    Gemini 3.6 Flash High

    Google

    73.6

    Samlet

    0,235 US$

    pr. vellykket opgave

    Matematik86.4Ræsonnement85.1Sprog83.9
  40. 40

    GLM-5.2

    åben

    Z.AI

    73.2

    Samlet

    0,225 US$

    pr. vellykket opgave

    Matematik89.8Kodning79.7Ræsonnement78.6
  41. 41

    Qwen 3.7 Max

    Alibaba

    73.1

    Samlet

    0,182 US$

    pr. vellykket opgave

    Matematik85.2Ræsonnement83.3Sprog79.7
  42. 42

    Claude 4.6 Sonnet Thinking Medium Effort

    Anthropic

    73.0

    Samlet

    0,306 US$

    pr. vellykket opgave

    Matematik87.0Ræsonnement84.8Kodning79.3
  43. 43

    Claude 4.5 Opus Thinking High Effort

    Anthropic

    72.6

    Samlet

    0,610 US$

    pr. vellykket opgave

    Matematik90.4Sprog81.3Ræsonnement80.1
  44. 44

    GPT-6 Luna Max Effort

    OpenAI

    72.0

    Samlet

    0,026 US$

    pr. vellykket opgave

    Matematik89.1Ræsonnement81.8Kodning79.0
  45. 45

    Inkling xHigh Effort

    åben

    Thinking Machines

    71.9

    Samlet

    0,310 US$

    pr. vellykket opgave

    Matematik88.4Ræsonnement78.3Sprog73.5
  46. 46

    GLM-5.3 Flash

    åben

    Z.AI

    71.6

    Samlet

    0,031 US$

    pr. vellykket opgave

    Matematik81.2Kodning79.0Ræsonnement77.6
  47. 47

    Kimi K2.6 Thinking

    åben

    Moonshot AI

    70.5

    Samlet

    0,169 US$

    pr. vellykket opgave

    Matematik84.3Ræsonnement79.4Kodning78.6
  48. 48

    GPT-5.4 Nano xHigh

    OpenAI

    69.6

    Samlet

    0,091 US$

    pr. vellykket opgave

    Matematik91.0Ræsonnement81.1Kodning70.8
  49. 49

    ox-alpha-max

    Stealth

    69.2

    Samlet

    0,000 US$

    pr. vellykket opgave

    Matematik77.5Ræsonnement76.6Kodning75.8
  50. 50

    Qwen 3.6 Plus

    Alibaba

    68.9

    Samlet

    0,227 US$

    pr. vellykket opgave

    Matematik83.7Kodning78.2Ræsonnement75.8
  51. 51

    Kimi K2.7 Code

    åben

    Moonshot AI

    68.4

    Samlet

    0,100 US$

    pr. vellykket opgave

    Ræsonnement82.8Matematik79.6Sprog77.9
  52. 52

    Grok Build 0.1

    xAI

    67.8

    Samlet

    0,024 US$

    pr. vellykket opgave

    Matematik78.4Ræsonnement76.4Sprog72.5
  53. 53

    Nemotron 3 Ultra 550B A55B

    åben

    NVIDIA

    67.4

    Samlet

    0,371 US$

    pr. vellykket opgave

    Matematik88.7Ræsonnement74.7Følge instruktioner73.4
  54. 54

    Minimax M3

    Minimax

    67.3

    Samlet

    0,060 US$

    pr. vellykket opgave

    Matematik76.9Sprog76.8Dataanalyse76.2
  55. 55

    GPT-5.4 Mini xHigh

    OpenAI

    66.4

    Samlet

    0,334 US$

    pr. vellykket opgave

    Matematik78.5Kodning71.6Ræsonnement71.3
  56. 56

    Qwen 3.6 27B

    åben

    Alibaba

    64.0

    Samlet

    0,202 US$

    pr. vellykket opgave

    Matematik79.9Kodning71.8Dataanalyse70.4
  57. 57

    Gemini 3.5 Flash-Lite High

    Google

    63.9

    Samlet

    0,069 US$

    pr. vellykket opgave

    Kodning76.1Matematik73.7Sprog71.8
  58. 58

    Grok 4.3

    xAI

    62.3

    Samlet

    0,061 US$

    pr. vellykket opgave

    Matematik84.3Sprog73.6Ræsonnement70.8

Prisen er kildens tal for pris pr. vellykket opgave for det valgte omfang.

Scorerne er et øjebliksbillede af en offentlig benchmark fra en tredjepart, gengivet uændret. Dapols tilføjer analysen af pris pr. vellykket opgave ovenpå.Se kilde

A benchmark rank is not a hiring decision.

These scores say which model is strongest at a set of held-out tasks. They don’t say which one fits your workflow, your budget, or the tools you already pay for — and the cheapest model that clears your bar usually beats the highest scorer.