Grok 4.6
Same $2 / $6 API price as Grok 4.5. xAI reports an Artificial Analysis Intelligence Index of 61 — tied with GPT-5.6 Sol Max, one point behind Fable 5 Max. Strong on knowledge-work evals; 26% on Terminal-Bench v3.
Read the Grok 4.6 briefingAI kıyaslamaları
A practical view of published model scores that helps you compare capability, category strengths, and run cost without losing the detail.
Latest benchmark & model updates
The leaderboard on this page is LiveBench's 25 June release, re-captured on 22 September 2026. It now includes Grok 4.7 xHigh and DeepSeek V4.1 Flash Max Effort. The model notes below are from the vendors' own pages, labelled as such.
Same $2 / $6 API price as Grok 4.5. xAI reports an Artificial Analysis Intelligence Index of 61 — tied with GPT-5.6 Sol Max, one point behind Fable 5 Max. Strong on knowledge-work evals; 26% on Terminal-Bench v3.
Read the Grok 4.6 briefingDeepSeek V4.1 Flash replaced V4 Flash on 10 Sep 2026 on the new deepseek-flash API id, at $0.15 / $0.60 per 1M tokens off-peak and $0.30 / $1.20 at peak. From 14 Sep, V4 Pro requests are routed to it too, so switch model ids now. LiveBench now scores V4.1 Flash Max Effort at 81.1 overall.
See it in the model trackerLeaderboard rows come only from published LiveBench data. We do not invent scores.
Best overall
Claude Fable 5.1 Max Effort leads this snapshot at 83.4 overall, $1.212 per successful task.
Best value per task
Union Alpha runs at $0.000 per successful task and still scores 76.1 overall.
Best open weights
DeepSeek V4.1 Flash Max Effort is the strongest open-weight model here at 81.1 overall — the option you can host yourself.
Best per capability
If your work is mostly one kind of task, these lead their category in this snapshot.
Every number above comes from the 2026-06-25 release dated 2026-06-25, published by a third-party benchmark and reproduced unaltered.
İlk grafik 'kim en güçlü' sorusunu yanıtlar. İkincisi ise size gerçekten paraya mal olan soruyu yanıtlar: hangisi için ödeme yapmaya değer?
Daha uzun daha iyidir. Çubuklar Genel puanını 100 üzerinden gösterir; her çubuğun yanındaki sayı tam değerdir. Bir satırı seçerek o modeli aşağıdaki maliyet grafiğine taşıyın.
Toplam 54 modelin ilk 12 tanesi gösteriliyor. Tüm modeller için tam karşılaştırma görünümüne geçin.
Yukarısı daha güçlü, solu daha ucuz — yani en iyi alımlar sol üstte yer alır. Basamaklı çizgi, daha ucuz hiçbir şeyin geçemediği modelleri birbirine bağlar; altındaki her şey, daha düşük maliyetli bir model tarafından geride bırakılır.
Selected
Claude Fable 5.1 Max Effort
Anthropic
#5 · Değer sınırında.
Best buys (cheapest → strongest)
Grafiğe sekme tuşuyla girin, ardından ok tuşlarını kullanarak modelleri en ucuzdan en pahalıya doğru gezin.
| Model | Kuruluş | Genel | başarılı görev başına |
|---|---|---|---|
| Claude Fable 5.1 Max Effort#5 · Fiyatına göre en iyi değer | Anthropic | 83.4 | $1,212 |
| Claude Fable 5 Max Effort | Anthropic | 83.0 | $1,439 |
| GPT-6 Astra Max Effort#4 · Fiyatına göre en iyi değer | OpenAI | 82.2 | $0,736 |
| Muse Spark 1.3 xHigh Effort#3 · Fiyatına göre en iyi değer | Meta | 81.6 | $0,219 |
| DeepSeek V4.1 Flash Max Effort#2 · Fiyatına göre en iyi değer | DeepSeek | 81.1 | $0,029 |
| GPT-5.6 Sol Max Effort | OpenAI | 81.0 | $0,515 |
| GPT-5.5 Thinking xHigh Effort | OpenAI | 80.2 | $0,435 |
| Claude 5 Opus Thinking Max Effort | Anthropic | 80.1 | $0,699 |
| Kimi K3 | Moonshot AI | 79.2 | $0,348 |
| Gemini 3.7 Flash High | 78.8 | $0,157 | |
| Qwen 3.8 Max | Alibaba | 78.5 | $0,275 |
| Grok 4.6 | xAI | 78.0 | $0,207 |
| Muse Spark 1.2 xHigh Effort | Meta | 78.0 | $0,375 |
| GPT-5.4 Thinking xHigh Effort | OpenAI | 78.0 | $0,387 |
| GPT-5.6 Terra Max Effort | OpenAI | 77.9 | $0,352 |
| DeepSeek V4 Pro 0813 | DeepSeek | 77.4 | $0,044 |
| Grok 4.7 xHigh | xAI | 77.4 | $0,718 |
| Gemini 3.1 Pro Preview High | 77.0 | $0,286 | |
| DeepSeek V4 Flash Vision Exp | DeepSeek | 76.8 | $0,051 |
| Claude 4.7 Opus Thinking xHigh Effort | Anthropic | 76.5 | $0,528 |
| Qwen 3.8 Flash Next | Alibaba | 76.2 | $0,042 |
| Claude 4.8 Opus Thinking Max Effort | Anthropic | 76.2 | $0,983 |
| GLM-5.3 | Z.AI | 76.1 | $0,450 |
| Claude Sonnet 5 xHigh Effort | Anthropic | 76.0 | $0,505 |
| Grok 4.5 | xAI | 75.8 | $0,131 |
| Gemini 3.8 Flash High | 75.8 | $0,307 | |
| Qwen3.8 27B | Alibaba | 75.3 | $0,094 |
| Muse Spark 1.1 xHigh Effort | Meta | 75.3 | $0,198 |
| GPT-5.2 High | OpenAI | 74.6 | $0,234 |
| Gemini 3.5 Flash High | 74.6 | $0,249 | |
| Claude 4.6 Opus Thinking High Effort | Anthropic | 74.5 | $0,404 |
| DeepSeek V4 Flash 0731 | DeepSeek | 74.2 | $0,060 |
| GPT-5.2 Codex | OpenAI | 74.0 | $0,187 |
| GPT-5.6 Luna Max Effort | OpenAI | 73.6 | $0,169 |
| Gemini 3.6 Flash High | 73.6 | $0,235 | |
| GLM-5.2 | Z.AI | 73.2 | $0,225 |
| Qwen 3.7 Max | Alibaba | 73.1 | $0,182 |
| Claude 4.6 Sonnet Thinking Medium Effort | Anthropic | 73.0 | $0,306 |
| Claude 4.5 Opus Thinking High Effort | Anthropic | 72.6 | $0,610 |
| Inkling xHigh Effort | Thinking Machines | 71.9 | $0,310 |
| GLM-5.3 Flash | Z.AI | 71.6 | $0,031 |
| Kimi K2.6 Thinking | Moonshot AI | 70.5 | $0,169 |
| GPT-5.4 Nano xHigh | OpenAI | 69.6 | $0,091 |
| Qwen 3.6 Plus | Alibaba | 68.9 | $0,227 |
| Kimi K2.7 Code | Moonshot AI | 68.4 | $0,100 |
| Grok Build 0.1#1 · Fiyatına göre en iyi değer | xAI | 67.8 | $0,024 |
| Nemotron 3 Ultra 550B A55B | NVIDIA | 67.4 | $0,371 |
| Minimax M3 | Minimax | 67.3 | $0,060 |
| GPT-5.4 Mini xHigh | OpenAI | 66.4 | $0,334 |
| Qwen 3.6 27B | Alibaba | 64.0 | $0,202 |
| Gemini 3.5 Flash-Lite High | 63.9 | $0,069 | |
| Grok 4.3 | xAI | 62.3 | $0,061 |
Yedi kategori puanını karşılaştırmak için lider tablosundan en fazla üç model seçin.
Her eksen 0'dan 100'e kadar uzanır. Sağa doğru güç artar; kalın rakam o satırdaki liderdir.
| Kategori | Claude Fable 5.1 Max Effort | Union Alpha | DeepSeek V4.1 Flash Max Effort |
|---|---|---|---|
| Muhakeme | 91.7 | 80.8 | 86.7 |
| Kodlama | 86.4 | 82.1 | 80.0 |
| Ajan kodlama | 66.1 | 54.7 | 77.3 |
| Matematik | 97.0 | 95.3 | 93.3 |
| Veri analizi | 80.3 | 74.6 | 79.3 |
| Dil | 89.5 | 85.9 | 81.2 |
| Talimat takibi | 73.0 | 59.5 | 70.0 |
Her kategoriyi sıralayın, listeyi daraltın ve yayınlanan alt görev dökümü için bir modeli açın.
Claude Fable 5.1 Max Effort
Anthropic
83.4
Genel
$1,212
başarılı görev başına
Claude Fable 5 Max Effort
Anthropic
83.0
Genel
$1,439
başarılı görev başına
GPT-6 Astra Max Effort
OpenAI
82.2
Genel
$0,736
başarılı görev başına
Muse Spark 1.3 xHigh Effort
Meta
81.6
Genel
$0,219
başarılı görev başına
DeepSeek V4.1 Flash Max Effort
açDeepSeek
81.1
Genel
$0,029
başarılı görev başına
GPT-5.6 Sol Max Effort
OpenAI
81.0
Genel
$0,515
başarılı görev başına
GPT-5.5 Thinking xHigh Effort
OpenAI
80.2
Genel
$0,435
başarılı görev başına
Claude 5 Opus Thinking Max Effort
Anthropic
80.1
Genel
$0,699
başarılı görev başına
Kimi K3
açMoonshot AI
79.2
Genel
$0,348
başarılı görev başına
Gemini 3.7 Flash High
78.8
Genel
$0,157
başarılı görev başına
Qwen 3.8 Max
açAlibaba
78.5
Genel
$0,275
başarılı görev başına
Muse Spark 1.2 xHigh Effort
Meta
78.0
Genel
$0,375
başarılı görev başına
GPT-5.4 Thinking xHigh Effort
OpenAI
78.0
Genel
$0,387
başarılı görev başına
Grok 4.6
xAI
78.0
Genel
$0,207
başarılı görev başına
GPT-5.6 Terra Max Effort
OpenAI
77.9
Genel
$0,352
başarılı görev başına
DeepSeek V4 Pro 0813
açDeepSeek
77.4
Genel
$0,044
başarılı görev başına
Grok 4.7 xHigh
xAI
77.4
Genel
$0,718
başarılı görev başına
Gemini 3.1 Pro Preview High
77.0
Genel
$0,286
başarılı görev başına
DeepSeek V4 Flash Vision Exp
açDeepSeek
76.8
Genel
$0,051
başarılı görev başına
Claude 4.7 Opus Thinking xHigh Effort
Anthropic
76.5
Genel
$0,528
başarılı görev başına
Qwen 3.8 Flash Next
açAlibaba
76.2
Genel
$0,042
başarılı görev başına
Claude 4.8 Opus Thinking Max Effort
Anthropic
76.2
Genel
$0,983
başarılı görev başına
GLM-5.3
açZ.AI
76.1
Genel
$0,450
başarılı görev başına
Union Alpha
Stealth
76.1
Genel
$0,000
başarılı görev başına
Claude Sonnet 5 xHigh Effort
Anthropic
76.0
Genel
$0,505
başarılı görev başına
Gemini 3.8 Flash High
75.8
Genel
$0,307
başarılı görev başına
Grok 4.5
xAI
75.8
Genel
$0,131
başarılı görev başına
Qwen3.8 27B
açAlibaba
75.3
Genel
$0,094
başarılı görev başına
Muse Spark 1.1 xHigh Effort
Meta
75.3
Genel
$0,198
başarılı görev başına
GPT-5.2 High
OpenAI
74.6
Genel
$0,234
başarılı görev başına
Gemini 3.5 Flash High
74.6
Genel
$0,249
başarılı görev başına
Claude 4.6 Opus Thinking High Effort
Anthropic
74.5
Genel
$0,404
başarılı görev başına
DeepSeek V4 Flash 0731
açDeepSeek
74.2
Genel
$0,060
başarılı görev başına
GPT-5.2 Codex
OpenAI
74.0
Genel
$0,187
başarılı görev başına
Gemini 3.6 Flash High
73.6
Genel
$0,235
başarılı görev başına
GPT-5.6 Luna Max Effort
OpenAI
73.6
Genel
$0,169
başarılı görev başına
GLM-5.2
açZ.AI
73.2
Genel
$0,225
başarılı görev başına
Qwen 3.7 Max
Alibaba
73.1
Genel
$0,182
başarılı görev başına
Claude 4.6 Sonnet Thinking Medium Effort
Anthropic
73.0
Genel
$0,306
başarılı görev başına
Claude 4.5 Opus Thinking High Effort
Anthropic
72.6
Genel
$0,610
başarılı görev başına
Inkling xHigh Effort
açThinking Machines
71.9
Genel
$0,310
başarılı görev başına
GLM-5.3 Flash
açZ.AI
71.6
Genel
$0,031
başarılı görev başına
Kimi K2.6 Thinking
açMoonshot AI
70.5
Genel
$0,169
başarılı görev başına
GPT-5.4 Nano xHigh
OpenAI
69.6
Genel
$0,091
başarılı görev başına
ox-alpha-max
Stealth
69.2
Genel
$0,000
başarılı görev başına
Qwen 3.6 Plus
Alibaba
68.9
Genel
$0,227
başarılı görev başına
Kimi K2.7 Code
açMoonshot AI
68.4
Genel
$0,100
başarılı görev başına
Grok Build 0.1
xAI
67.8
Genel
$0,024
başarılı görev başına
Nemotron 3 Ultra 550B A55B
açNVIDIA
67.4
Genel
$0,371
başarılı görev başına
Minimax M3
Minimax
67.3
Genel
$0,060
başarılı görev başına
GPT-5.4 Mini xHigh
OpenAI
66.4
Genel
$0,334
başarılı görev başına
Qwen 3.6 27B
açAlibaba
64.0
Genel
$0,202
başarılı görev başına
Gemini 3.5 Flash-Lite High
63.9
Genel
$0,069
başarılı görev başına
Grok 4.3
xAI
62.3
Genel
$0,061
başarılı görev başına
Cost is the source-provided cost-per-successful-task metric for the selected scope.
These scores say which model is strongest at a set of held-out tasks. They don’t say which one fits your workflow, your budget, or the tools you already pay for — and the cheapest model that clears your bar usually beats the highest scorer.
What changed recently
Dated releases from every major lab, with the vendor's own claims labelled as claims.
OpenWhat it costs to run
Our tool catalogue carries the price we last verified and the date we checked it.
OpenWhat to actually build
A deployment plan picks the stack for one workflow at your budget — models included.
Open