Hoppa till huvudinnehållet

AI-benchmarks

AI-modeller, jämförda på kvalitet och kostnad.

En praktisk vy över publicerade modellresultat som hjälper dig att jämföra förmåga, styrkor per kategori och körkostnad utan att tappa detaljerna.

Utforska topplistanKälla för benchmark Senaste valda version · 25 juni 2026

Senaste nytt om benchmarks och modeller

Topplistan på den här sidan är LiveBench version 25 juni, hämtad på nytt den 22 september 2026. Den innehåller nu Grok 4.7 xHigh och DeepSeek V4.1 Flash Max Effort. Modellanteckningarna nedan kommer från leverantörernas egna sidor och är märkta som sådana.

Grok 4.6

Samma API-pris på $2 / $6 som Grok 4.5. xAI rapporterar ett Artificial Analysis Intelligence Index på 61 – delad plats med GPT-5.6 Sol Max, en poäng efter Fable 5 Max. Stark i utvärderingar av kunskapsarbete; 26 % på Terminal-Bench v3.

Läs genomgången av Grok 4.6

DeepSeek V4.1 Flash

DeepSeek V4.1 Flash ersatte V4 Flash den 10 sep 2026 under det nya API-id:t deepseek-flash, för $0.15 / $0.60 per 1M tokens utanför rusningstid och $0.30 / $1.20 vid rusningstid. Från den 14 sep dirigeras även anrop till V4 Pro dit, så byt modell-id nu. LiveBench ger nu V4.1 Flash Max Effort 81.1 totalt.

Se den i modellbevakningen

Raderna i topplistan kommer enbart från publicerade LiveBench-data. Vi hittar inte på resultat.

Best overall

Claude Fable 5.1 Max Effort leads this snapshot at 83.4 overall, $1.212 per successful task.

Best value per task

ox-alpha-max runs at $0.000 per successful task and still scores 69.2 overall.

Best open weights

DeepSeek V4.1 Flash Max Effort is the strongest open-weight model here at 81.1 overall — the option you can host yourself.

Best per capability

If your work is mostly one kind of task, these lead their category in this snapshot.

Resonemang
GPT-6 Astra Max Effort 92.7
Kodning
Claude 5.5 Opus Thinking Max Effort 89.3
Agentisk kodning
DeepSeek V4.1 Flash Max Effort 77.3
Matematik
Claude 5.5 Opus Thinking Max Effort 97.1
Dataanalys
GPT-6 Astra Max Effort 83.0
Språk
Claude Fable 5 Max Effort 90.7
Att följa instruktioner
Gemini 3.8 Flash High 81.4

Every number above comes from the 2026-06-25 release dated 2026-06-25, published by a third-party benchmark and reproduced unaltered.

Fältets form, i två bilder.

Det första diagrammet svarar på ”vem är starkast”. Det andra svarar på frågan som faktiskt kostar dig pengar: vilka av dem är värda att betala för.

Så rankas de

Längre är bättre. Staplarna visar resultatet för Totalt av 100; siffran bredvid varje stapel är det exakta värdet. Välj en rad för att ta med modellen till kostnadsdiagrammet nedan.

Visar de 12 bästa av 58. Byt till den fullständiga jämförelsevyn för att se alla modeller.

Kvalitet mot kostnad

Uppåt är starkare, vänster är billigare – så de bästa köpen ligger uppe till vänster. Numrerade punkter är värdefronten: inget billigare får högre resultat. Grå punkter slås på både resultat och pris.

606570758085900,024 US$0,050 US$0,100 US$0,200 US$0,500 US$1,00 US$1,439 US$1234567Claude Fable 5.1 Max Effort83.4 · 1,212 US$Kostnad per lyckad uppgift (logaritmisk skala – varje steg är en multipel, inte ett tillägg)Totalt

Vald

Claude Fable 5.1 Max Effort

Anthropic

Totalt
83.4
per lyckad uppgift
1,212 US$

#7 · På värdefronten.

Bästa köpen (billigast → starkast)

  • Bäst värde för priset
  • Slagen på både resultat och pris

Hovra över eller tryck på en numrerad punkt (eller dess rad till höger) för att läsa exakt resultat och kostnad. Piltangenterna går igenom modellerna från billigast till dyrast.

Läs samma 57 siffror som en tabell
Kvalitet mot kostnad
ModellOrganisationTotaltper lyckad uppgift
Claude Fable 5.1 Max Effort#7 · Bäst värde för prisetAnthropic83.41,212 US$
Claude 5.5 Opus Thinking Max Effort#6 · Bäst värde för prisetAnthropic83.20,799 US$
Claude Fable 5 Max EffortAnthropic83.01,439 US$
GPT-6 Astra Max Effort#5 · Bäst värde för prisetOpenAI82.20,736 US$
GPT-6.1 Sol Max Effort#4 · Bäst värde för prisetOpenAI81.60,142 US$
Muse Spark 1.3 xHigh EffortMeta81.60,219 US$
DeepSeek V4.1 Flash Max Effort#3 · Bäst värde för prisetDeepSeek81.10,029 US$
GPT-5.6 Sol Max EffortOpenAI81.00,515 US$
GPT-5.5 Thinking xHigh EffortOpenAI80.20,435 US$
Claude 5 Opus Thinking Max EffortAnthropic80.10,699 US$
GPT-6 Sol Max EffortOpenAI79.30,268 US$
Kimi K3Moonshot AI79.20,348 US$
Gemini 3.7 Flash HighGoogle78.80,157 US$
Qwen 3.8 MaxAlibaba78.50,275 US$
Grok 4.6 xHighxAI78.00,207 US$
Muse Spark 1.2 xHigh EffortMeta78.00,375 US$
GPT-5.4 Thinking xHigh EffortOpenAI78.00,387 US$
GPT-5.6 Terra Max EffortOpenAI77.90,352 US$
Claude Sonnet 5.5 xHigh EffortAnthropic77.80,141 US$
DeepSeek V4 Pro 0813DeepSeek77.40,044 US$
Grok 4.7 xHighxAI77.40,718 US$
Gemini 3.1 Pro Preview HighGoogle77.00,286 US$
DeepSeek V4 Flash Vision ExpDeepSeek76.80,051 US$
Claude 4.7 Opus Thinking xHigh EffortAnthropic76.50,528 US$
Qwen 3.8 Flash NextAlibaba76.20,042 US$
Claude 4.8 Opus Thinking Max EffortAnthropic76.20,983 US$
GLM-5.3Z.AI76.10,450 US$
Claude Sonnet 5 xHigh EffortAnthropic76.00,505 US$
Grok 4.5xAI75.80,131 US$
Gemini 3.8 Flash HighGoogle75.80,307 US$
Qwen3.8 27BAlibaba75.30,094 US$
Muse Spark 1.1 xHigh EffortMeta75.30,198 US$
GPT-5.2 HighOpenAI74.60,234 US$
Gemini 3.5 Flash HighGoogle74.60,249 US$
Claude 4.6 Opus Thinking High EffortAnthropic74.50,404 US$
DeepSeek V4 Flash 0731DeepSeek74.20,060 US$
GPT-5.2 CodexOpenAI74.00,187 US$
GPT-5.6 Luna Max EffortOpenAI73.60,169 US$
Gemini 3.6 Flash HighGoogle73.60,235 US$
GLM-5.2Z.AI73.20,225 US$
Qwen 3.7 MaxAlibaba73.10,182 US$
Claude 4.6 Sonnet Thinking Medium EffortAnthropic73.00,306 US$
Claude 4.5 Opus Thinking High EffortAnthropic72.60,610 US$
GPT-6 Luna Max Effort#2 · Bäst värde för prisetOpenAI72.00,026 US$
Inkling xHigh EffortThinking Machines71.90,310 US$
GLM-5.3 FlashZ.AI71.60,031 US$
Kimi K2.6 ThinkingMoonshot AI70.50,169 US$
GPT-5.4 Nano xHighOpenAI69.60,091 US$
Qwen 3.6 PlusAlibaba68.90,227 US$
Kimi K2.7 CodeMoonshot AI68.40,100 US$
Grok Build 0.1#1 · Bäst värde för prisetxAI67.80,024 US$
Nemotron 3 Ultra 550B A55BNVIDIA67.40,371 US$
Minimax M3Minimax67.30,060 US$
GPT-5.4 Mini xHighOpenAI66.40,334 US$
Qwen 3.6 27BAlibaba64.00,202 US$
Gemini 3.5 Flash-Lite HighGoogle63.90,069 US$
Grok 4.3xAI62.30,061 US$

Profil per kategori

Välj upp till tre modeller i topplistan för att jämföra deras resultat i sju kategorier.

  • Claude Fable 5.1 Max Effort83.4
  • ox-alpha-max69.2
  • DeepSeek V4.1 Flash Max Effort81.1
  • Resonemang91.776.686.7
  • Kodning86.475.880.0
  • Agentisk kodning66.152.677.3
  • Matematik97.077.593.3
  • Dataanalys80.375.879.3
  • Språk89.566.181.2
  • Att följa instruktioner73.060.370.0

Varje skala går från 0 till 100. Längre till höger är starkare; den fetstilta siffran är ledaren i raden.

Läs resultaten som en tabell
Profil per kategori
KategoriClaude Fable 5.1 Max Effortox-alpha-maxDeepSeek V4.1 Flash Max Effort
Resonemang91.776.686.7
Kodning86.475.880.0
Agentisk kodning66.152.677.3
Matematik97.077.593.3
Dataanalys80.375.879.3
Språk89.566.181.2
Att följa instruktioner73.060.370.0

Topplista

Sortera varje kategori, avgränsa listan och öppna en modell för att se dess publicerade resultat per deluppgift.

  1. 01

    Claude Fable 5.1 Max Effort

    Anthropic

    83.4

    Totalt

    1,212 US$

    per lyckad uppgift

    Matematik97.0Resonemang91.7Språk89.5
  2. 02

    Claude 5.5 Opus Thinking Max Effort

    Anthropic

    83.2

    Totalt

    0,799 US$

    per lyckad uppgift

    Matematik97.1Resonemang92.2Kodning89.3
  3. 03

    Claude Fable 5 Max Effort

    Anthropic

    83.0

    Totalt

    1,439 US$

    per lyckad uppgift

    Matematik96.0Språk90.7Resonemang89.7
  4. 04

    GPT-6 Astra Max Effort

    OpenAI

    82.2

    Totalt

    0,736 US$

    per lyckad uppgift

    Matematik96.8Resonemang92.7Språk89.4
  5. 05

    GPT-6.1 Sol Max Effort

    OpenAI

    81.6

    Totalt

    0,142 US$

    per lyckad uppgift

    Matematik96.8Resonemang92.6Språk90.1
  6. 06

    Muse Spark 1.3 xHigh Effort

    Meta

    81.6

    Totalt

    0,219 US$

    per lyckad uppgift

    Matematik95.9Resonemang89.7Språk82.8
  7. 07

    DeepSeek V4.1 Flash Max Effort

    öppen

    DeepSeek

    81.1

    Totalt

    0,029 US$

    per lyckad uppgift

    Matematik93.3Resonemang86.7Språk81.2
  8. 08

    GPT-5.6 Sol Max Effort

    OpenAI

    81.0

    Totalt

    0,515 US$

    per lyckad uppgift

    Matematik96.2Resonemang91.7Språk87.7
  9. 09

    GPT-5.5 Thinking xHigh Effort

    OpenAI

    80.2

    Totalt

    0,435 US$

    per lyckad uppgift

    Matematik95.9Resonemang89.7Språk87.4
  10. 10

    Claude 5 Opus Thinking Max Effort

    Anthropic

    80.1

    Totalt

    0,699 US$

    per lyckad uppgift

    Matematik95.7Resonemang91.2Språk88.7
  11. 11

    GPT-6 Sol Max Effort

    OpenAI

    79.3

    Totalt

    0,268 US$

    per lyckad uppgift

    Matematik96.4Resonemang88.7Språk85.3
  12. 12

    Kimi K3

    öppen

    Moonshot AI

    79.2

    Totalt

    0,348 US$

    per lyckad uppgift

    Resonemang90.7Språk85.5Matematik84.4
  13. 13

    Gemini 3.7 Flash High

    Google

    78.8

    Totalt

    0,157 US$

    per lyckad uppgift

    Matematik93.5Resonemang87.8Språk85.5
  14. 14

    Qwen 3.8 Max

    öppen

    Alibaba

    78.5

    Totalt

    0,275 US$

    per lyckad uppgift

    Matematik91.3Resonemang88.2Språk79.7
  15. 15

    Muse Spark 1.2 xHigh Effort

    Meta

    78.0

    Totalt

    0,375 US$

    per lyckad uppgift

    Matematik91.2Resonemang90.0Språk78.6
  16. 16

    Grok 4.6 xHigh

    xAI

    78.0

    Totalt

    0,207 US$

    per lyckad uppgift

    Matematik92.6Resonemang90.5Språk83.7
  17. 17

    GPT-5.4 Thinking xHigh Effort

    OpenAI

    78.0

    Totalt

    0,387 US$

    per lyckad uppgift

    Matematik94.1Resonemang88.1Språk82.6
  18. 18

    GPT-5.6 Terra Max Effort

    OpenAI

    77.9

    Totalt

    0,352 US$

    per lyckad uppgift

    Matematik94.9Resonemang90.6Språk82.9
  19. 19

    Claude Sonnet 5.5 xHigh Effort

    Anthropic

    77.8

    Totalt

    0,141 US$

    per lyckad uppgift

    Matematik96.7Kodning88.9Resonemang86.8
  20. 20

    DeepSeek V4 Pro 0813

    öppen

    DeepSeek

    77.4

    Totalt

    0,044 US$

    per lyckad uppgift

    Matematik95.1Resonemang85.8Språk82.1
  21. 21

    Grok 4.7 xHigh

    xAI

    77.4

    Totalt

    0,718 US$

    per lyckad uppgift

    Matematik95.7Resonemang82.7Språk80.1
  22. 22

    Gemini 3.1 Pro Preview High

    Google

    77.0

    Totalt

    0,286 US$

    per lyckad uppgift

    Matematik91.0Språk85.4Resonemang84.0
  23. 23

    DeepSeek V4 Flash Vision Exp

    öppen

    DeepSeek

    76.8

    Totalt

    0,051 US$

    per lyckad uppgift

    Matematik87.8Resonemang85.4Språk80.4
  24. 24

    Claude 4.7 Opus Thinking xHigh Effort

    Anthropic

    76.5

    Totalt

    0,528 US$

    per lyckad uppgift

    Matematik92.9Resonemang87.2Kodning82.1
  25. 25

    Claude 4.8 Opus Thinking Max Effort

    Anthropic

    76.2

    Totalt

    0,983 US$

    per lyckad uppgift

    Matematik94.3Resonemang89.2Kodning81.8
  26. 26

    Qwen 3.8 Flash Next

    öppen

    Alibaba

    76.2

    Totalt

    0,042 US$

    per lyckad uppgift

    Resonemang87.4Matematik85.8Att följa instruktioner77.1
  27. 27

    GLM-5.3

    öppen

    Z.AI

    76.1

    Totalt

    0,450 US$

    per lyckad uppgift

    Matematik87.9Resonemang85.8Språk79.9
  28. 28

    Claude Sonnet 5 xHigh Effort

    Anthropic

    76.0

    Totalt

    0,505 US$

    per lyckad uppgift

    Matematik92.9Resonemang88.7Kodning80.7
  29. 29

    Grok 4.5

    xAI

    75.8

    Totalt

    0,131 US$

    per lyckad uppgift

    Matematik90.8Resonemang87.2Språk82.8
  30. 30

    Gemini 3.8 Flash High

    Google

    75.8

    Totalt

    0,307 US$

    per lyckad uppgift

    Matematik91.6Resonemang89.3Språk87.8
  31. 31

    Qwen3.8 27B

    öppen

    Alibaba

    75.3

    Totalt

    0,094 US$

    per lyckad uppgift

    Matematik86.2Resonemang80.0Dataanalys76.6
  32. 32

    Muse Spark 1.1 xHigh Effort

    Meta

    75.3

    Totalt

    0,198 US$

    per lyckad uppgift

    Resonemang87.7Matematik87.1Kodning77.2
  33. 33

    GPT-5.2 High

    OpenAI

    74.6

    Totalt

    0,234 US$

    per lyckad uppgift

    Matematik93.2Resonemang83.2Språk79.8
  34. 34

    Gemini 3.5 Flash High

    Google

    74.6

    Totalt

    0,249 US$

    per lyckad uppgift

    Matematik88.2Språk84.6Resonemang82.0
  35. 35

    Claude 4.6 Opus Thinking High Effort

    Anthropic

    74.5

    Totalt

    0,404 US$

    per lyckad uppgift

    Matematik89.3Resonemang88.7Språk83.3
  36. 36

    DeepSeek V4 Flash 0731

    öppen

    DeepSeek

    74.2

    Totalt

    0,060 US$

    per lyckad uppgift

    Matematik86.8Resonemang86.6Dataanalys79.3
  37. 37

    GPT-5.2 Codex

    OpenAI

    74.0

    Totalt

    0,187 US$

    per lyckad uppgift

    Matematik88.8Kodning83.6Dataanalys78.2
  38. 38

    GPT-5.6 Luna Max Effort

    OpenAI

    73.6

    Totalt

    0,169 US$

    per lyckad uppgift

    Matematik87.2Resonemang85.6Kodning82.9
  39. 39

    Gemini 3.6 Flash High

    Google

    73.6

    Totalt

    0,235 US$

    per lyckad uppgift

    Matematik86.4Resonemang85.1Språk83.9
  40. 40

    GLM-5.2

    öppen

    Z.AI

    73.2

    Totalt

    0,225 US$

    per lyckad uppgift

    Matematik89.8Kodning79.7Resonemang78.6
  41. 41

    Qwen 3.7 Max

    Alibaba

    73.1

    Totalt

    0,182 US$

    per lyckad uppgift

    Matematik85.2Resonemang83.3Språk79.7
  42. 42

    Claude 4.6 Sonnet Thinking Medium Effort

    Anthropic

    73.0

    Totalt

    0,306 US$

    per lyckad uppgift

    Matematik87.0Resonemang84.8Kodning79.3
  43. 43

    Claude 4.5 Opus Thinking High Effort

    Anthropic

    72.6

    Totalt

    0,610 US$

    per lyckad uppgift

    Matematik90.4Språk81.3Resonemang80.1
  44. 44

    GPT-6 Luna Max Effort

    OpenAI

    72.0

    Totalt

    0,026 US$

    per lyckad uppgift

    Matematik89.1Resonemang81.8Kodning79.0
  45. 45

    Inkling xHigh Effort

    öppen

    Thinking Machines

    71.9

    Totalt

    0,310 US$

    per lyckad uppgift

    Matematik88.4Resonemang78.3Språk73.5
  46. 46

    GLM-5.3 Flash

    öppen

    Z.AI

    71.6

    Totalt

    0,031 US$

    per lyckad uppgift

    Matematik81.2Kodning79.0Resonemang77.6
  47. 47

    Kimi K2.6 Thinking

    öppen

    Moonshot AI

    70.5

    Totalt

    0,169 US$

    per lyckad uppgift

    Matematik84.3Resonemang79.4Kodning78.6
  48. 48

    GPT-5.4 Nano xHigh

    OpenAI

    69.6

    Totalt

    0,091 US$

    per lyckad uppgift

    Matematik91.0Resonemang81.1Kodning70.8
  49. 49

    ox-alpha-max

    Stealth

    69.2

    Totalt

    0,000 US$

    per lyckad uppgift

    Matematik77.5Resonemang76.6Kodning75.8
  50. 50

    Qwen 3.6 Plus

    Alibaba

    68.9

    Totalt

    0,227 US$

    per lyckad uppgift

    Matematik83.7Kodning78.2Resonemang75.8
  51. 51

    Kimi K2.7 Code

    öppen

    Moonshot AI

    68.4

    Totalt

    0,100 US$

    per lyckad uppgift

    Resonemang82.8Matematik79.6Språk77.9
  52. 52

    Grok Build 0.1

    xAI

    67.8

    Totalt

    0,024 US$

    per lyckad uppgift

    Matematik78.4Resonemang76.4Språk72.5
  53. 53

    Nemotron 3 Ultra 550B A55B

    öppen

    NVIDIA

    67.4

    Totalt

    0,371 US$

    per lyckad uppgift

    Matematik88.7Resonemang74.7Att följa instruktioner73.4
  54. 54

    Minimax M3

    Minimax

    67.3

    Totalt

    0,060 US$

    per lyckad uppgift

    Matematik76.9Språk76.8Dataanalys76.2
  55. 55

    GPT-5.4 Mini xHigh

    OpenAI

    66.4

    Totalt

    0,334 US$

    per lyckad uppgift

    Matematik78.5Kodning71.6Resonemang71.3
  56. 56

    Qwen 3.6 27B

    öppen

    Alibaba

    64.0

    Totalt

    0,202 US$

    per lyckad uppgift

    Matematik79.9Kodning71.8Dataanalys70.4
  57. 57

    Gemini 3.5 Flash-Lite High

    Google

    63.9

    Totalt

    0,069 US$

    per lyckad uppgift

    Kodning76.1Matematik73.7Språk71.8
  58. 58

    Grok 4.3

    xAI

    62.3

    Totalt

    0,061 US$

    per lyckad uppgift

    Matematik84.3Språk73.6Resonemang70.8

Kostnaden är källans mått på kostnad per lyckad uppgift för det valda urvalet.

Resultaten är en ögonblicksbild av en offentlig benchmark från tredje part, återgiven oförändrad. Dapols lägger till analysen av kostnad per lyckad uppgift ovanpå.Visa källan

A benchmark rank is not a hiring decision.

These scores say which model is strongest at a set of held-out tasks. They don’t say which one fits your workflow, your budget, or the tools you already pay for — and the cheapest model that clears your bar usually beats the highest scorer.