Grok 4.6
Same $2 / $6 API price as Grok 4.5. xAI reports an Artificial Analysis Intelligence Index of 61 — tied with GPT-5.6 Sol Max, one point behind Fable 5 Max. Strong on knowledge-work evals; 26% on Terminal-Bench v3.
Read the Grok 4.6 briefingAI बेंचमार्क
A practical view of published model scores that helps you compare capability, category strengths, and run cost without losing the detail.
Latest benchmark & model updates
The leaderboard on this page is LiveBench's 25 June release, re-captured on 22 September 2026. It now includes Grok 4.7 xHigh and DeepSeek V4.1 Flash Max Effort. The model notes below are from the vendors' own pages, labelled as such.
Same $2 / $6 API price as Grok 4.5. xAI reports an Artificial Analysis Intelligence Index of 61 — tied with GPT-5.6 Sol Max, one point behind Fable 5 Max. Strong on knowledge-work evals; 26% on Terminal-Bench v3.
Read the Grok 4.6 briefingDeepSeek V4.1 Flash replaced V4 Flash on 10 Sep 2026 on the new deepseek-flash API id, at $0.15 / $0.60 per 1M tokens off-peak and $0.30 / $1.20 at peak. From 14 Sep, V4 Pro requests are routed to it too, so switch model ids now. LiveBench now scores V4.1 Flash Max Effort at 81.1 overall.
See it in the model trackerLeaderboard rows come only from published LiveBench data. We do not invent scores.
Best overall
Claude Fable 5.1 Max Effort leads this snapshot at 83.4 overall, $1.212 per successful task.
Best value per task
Union Alpha runs at $0.000 per successful task and still scores 76.1 overall.
Best open weights
DeepSeek V4.1 Flash Max Effort is the strongest open-weight model here at 81.1 overall — the option you can host yourself.
Best per capability
If your work is mostly one kind of task, these lead their category in this snapshot.
Every number above comes from the 2026-06-25 release dated 2026-06-25, published by a third-party benchmark and reproduced unaltered.
पहला चार्ट उत्तर देता है 'सबसे मजबूत कौन है'। दूसरा उस प्रश्न का उत्तर देता है जो वास्तव में आपके पैसे खर्च करता है: उनमें से किसके लिए भुगतान करना उचित है।
लंबा बेहतर है। बार्स 100 में से कुल मिलाकर स्कोर दिखाते हैं; प्रत्येक बार के बगल में दिया गया अंक सटीक मान है। उस मॉडल को नीचे की लागत चार्ट में ले जाने के लिए एक पंक्ति चुनें।
शीर्ष 12 दिखाए जा रहे हैं, कुल 54 में से। हर मॉडल के लिए पूर्ण तुलना दृश्य पर जाएँ।
ऊपर मजबूत, बाईं ओर सस्ता — इसलिए सबसे अच्छी खरीद ऊपर-बाईं ओर होती है। सीढ़ीदार रेखा उन मॉडलों को जोड़ती है जिन्हें कोई सस्ता मॉडल नहीं हराता; इसके नीचे का हर मॉडल किसी सस्ते मॉडल से पीछे रह जाता है।
Selected
Claude Fable 5.1 Max Effort
Anthropic
#5 · मूल्य अग्रभाग पर।
Best buys (cheapest → strongest)
प्लॉट में टैब करें, फिर तीर कुंजियों का उपयोग करके मॉडलों को सबसे सस्ते से महंगे की ओर बढ़ाएँ।
| मॉडल | संगठन | कुल मिलाकर | प्रति सफल कार्य |
|---|---|---|---|
| Claude Fable 5.1 Max Effort#5 · इसकी कीमत पर सर्वोत्तम मूल्य | Anthropic | 83.4 | $1.212 |
| Claude Fable 5 Max Effort | Anthropic | 83.0 | $1.439 |
| GPT-6 Astra Max Effort#4 · इसकी कीमत पर सर्वोत्तम मूल्य | OpenAI | 82.2 | $0.736 |
| Muse Spark 1.3 xHigh Effort#3 · इसकी कीमत पर सर्वोत्तम मूल्य | Meta | 81.6 | $0.219 |
| DeepSeek V4.1 Flash Max Effort#2 · इसकी कीमत पर सर्वोत्तम मूल्य | DeepSeek | 81.1 | $0.029 |
| GPT-5.6 Sol Max Effort | OpenAI | 81.0 | $0.515 |
| GPT-5.5 Thinking xHigh Effort | OpenAI | 80.2 | $0.435 |
| Claude 5 Opus Thinking Max Effort | Anthropic | 80.1 | $0.699 |
| Kimi K3 | Moonshot AI | 79.2 | $0.348 |
| Gemini 3.7 Flash High | 78.8 | $0.157 | |
| Qwen 3.8 Max | Alibaba | 78.5 | $0.275 |
| Grok 4.6 | xAI | 78.0 | $0.207 |
| Muse Spark 1.2 xHigh Effort | Meta | 78.0 | $0.375 |
| GPT-5.4 Thinking xHigh Effort | OpenAI | 78.0 | $0.387 |
| GPT-5.6 Terra Max Effort | OpenAI | 77.9 | $0.352 |
| DeepSeek V4 Pro 0813 | DeepSeek | 77.4 | $0.044 |
| Grok 4.7 xHigh | xAI | 77.4 | $0.718 |
| Gemini 3.1 Pro Preview High | 77.0 | $0.286 | |
| DeepSeek V4 Flash Vision Exp | DeepSeek | 76.8 | $0.051 |
| Claude 4.7 Opus Thinking xHigh Effort | Anthropic | 76.5 | $0.528 |
| Qwen 3.8 Flash Next | Alibaba | 76.2 | $0.042 |
| Claude 4.8 Opus Thinking Max Effort | Anthropic | 76.2 | $0.983 |
| GLM-5.3 | Z.AI | 76.1 | $0.450 |
| Claude Sonnet 5 xHigh Effort | Anthropic | 76.0 | $0.505 |
| Grok 4.5 | xAI | 75.8 | $0.131 |
| Gemini 3.8 Flash High | 75.8 | $0.307 | |
| Qwen3.8 27B | Alibaba | 75.3 | $0.094 |
| Muse Spark 1.1 xHigh Effort | Meta | 75.3 | $0.198 |
| GPT-5.2 High | OpenAI | 74.6 | $0.234 |
| Gemini 3.5 Flash High | 74.6 | $0.249 | |
| Claude 4.6 Opus Thinking High Effort | Anthropic | 74.5 | $0.404 |
| DeepSeek V4 Flash 0731 | DeepSeek | 74.2 | $0.060 |
| GPT-5.2 Codex | OpenAI | 74.0 | $0.187 |
| GPT-5.6 Luna Max Effort | OpenAI | 73.6 | $0.169 |
| Gemini 3.6 Flash High | 73.6 | $0.235 | |
| GLM-5.2 | Z.AI | 73.2 | $0.225 |
| Qwen 3.7 Max | Alibaba | 73.1 | $0.182 |
| Claude 4.6 Sonnet Thinking Medium Effort | Anthropic | 73.0 | $0.306 |
| Claude 4.5 Opus Thinking High Effort | Anthropic | 72.6 | $0.610 |
| Inkling xHigh Effort | Thinking Machines | 71.9 | $0.310 |
| GLM-5.3 Flash | Z.AI | 71.6 | $0.031 |
| Kimi K2.6 Thinking | Moonshot AI | 70.5 | $0.169 |
| GPT-5.4 Nano xHigh | OpenAI | 69.6 | $0.091 |
| Qwen 3.6 Plus | Alibaba | 68.9 | $0.227 |
| Kimi K2.7 Code | Moonshot AI | 68.4 | $0.100 |
| Grok Build 0.1#1 · इसकी कीमत पर सर्वोत्तम मूल्य | xAI | 67.8 | $0.024 |
| Nemotron 3 Ultra 550B A55B | NVIDIA | 67.4 | $0.371 |
| Minimax M3 | Minimax | 67.3 | $0.060 |
| GPT-5.4 Mini xHigh | OpenAI | 66.4 | $0.334 |
| Qwen 3.6 27B | Alibaba | 64.0 | $0.202 |
| Gemini 3.5 Flash-Lite High | 63.9 | $0.069 | |
| Grok 4.3 | xAI | 62.3 | $0.061 |
लीडरबोर्ड से तीन मॉडल चुनें उनके सात श्रेणी स्कोर की तुलना करने के लिए।
हर ट्रैक 0 से 100 तक चलता है। दाईं ओर जितना अधिक, उतना मजबूत; बोल्ड आंकड़ा उस पंक्ति में अग्रणी है।
| श्रेणी | Claude Fable 5.1 Max Effort | Union Alpha | DeepSeek V4.1 Flash Max Effort |
|---|---|---|---|
| तर्क | 91.7 | 80.8 | 86.7 |
| कोडिंग | 86.4 | 82.1 | 80.0 |
| एजेंटिक कोडिंग | 66.1 | 54.7 | 77.3 |
| गणित | 97.0 | 95.3 | 93.3 |
| डेटा विश्लेषण | 80.3 | 74.6 | 79.3 |
| भाषा | 89.5 | 85.9 | 81.2 |
| निर्देश अनुसरण | 73.0 | 59.5 | 70.0 |
प्रत्येक श्रेणी को क्रमबद्ध करें, सूची को संकीर्ण करें, और किसी मॉडल को उसके प्रकाशित उप-कार्य विवरण के लिए खोलें।
Claude Fable 5.1 Max Effort
Anthropic
83.4
कुल मिलाकर
$1.212
प्रति सफल कार्य
Claude Fable 5 Max Effort
Anthropic
83.0
कुल मिलाकर
$1.439
प्रति सफल कार्य
GPT-6 Astra Max Effort
OpenAI
82.2
कुल मिलाकर
$0.736
प्रति सफल कार्य
Muse Spark 1.3 xHigh Effort
Meta
81.6
कुल मिलाकर
$0.219
प्रति सफल कार्य
DeepSeek V4.1 Flash Max Effort
खुलाDeepSeek
81.1
कुल मिलाकर
$0.029
प्रति सफल कार्य
GPT-5.6 Sol Max Effort
OpenAI
81.0
कुल मिलाकर
$0.515
प्रति सफल कार्य
GPT-5.5 Thinking xHigh Effort
OpenAI
80.2
कुल मिलाकर
$0.435
प्रति सफल कार्य
Claude 5 Opus Thinking Max Effort
Anthropic
80.1
कुल मिलाकर
$0.699
प्रति सफल कार्य
Kimi K3
खुलाMoonshot AI
79.2
कुल मिलाकर
$0.348
प्रति सफल कार्य
Gemini 3.7 Flash High
78.8
कुल मिलाकर
$0.157
प्रति सफल कार्य
Qwen 3.8 Max
खुलाAlibaba
78.5
कुल मिलाकर
$0.275
प्रति सफल कार्य
Muse Spark 1.2 xHigh Effort
Meta
78.0
कुल मिलाकर
$0.375
प्रति सफल कार्य
GPT-5.4 Thinking xHigh Effort
OpenAI
78.0
कुल मिलाकर
$0.387
प्रति सफल कार्य
Grok 4.6
xAI
78.0
कुल मिलाकर
$0.207
प्रति सफल कार्य
GPT-5.6 Terra Max Effort
OpenAI
77.9
कुल मिलाकर
$0.352
प्रति सफल कार्य
DeepSeek V4 Pro 0813
खुलाDeepSeek
77.4
कुल मिलाकर
$0.044
प्रति सफल कार्य
Grok 4.7 xHigh
xAI
77.4
कुल मिलाकर
$0.718
प्रति सफल कार्य
Gemini 3.1 Pro Preview High
77.0
कुल मिलाकर
$0.286
प्रति सफल कार्य
DeepSeek V4 Flash Vision Exp
खुलाDeepSeek
76.8
कुल मिलाकर
$0.051
प्रति सफल कार्य
Claude 4.7 Opus Thinking xHigh Effort
Anthropic
76.5
कुल मिलाकर
$0.528
प्रति सफल कार्य
Qwen 3.8 Flash Next
खुलाAlibaba
76.2
कुल मिलाकर
$0.042
प्रति सफल कार्य
Claude 4.8 Opus Thinking Max Effort
Anthropic
76.2
कुल मिलाकर
$0.983
प्रति सफल कार्य
GLM-5.3
खुलाZ.AI
76.1
कुल मिलाकर
$0.450
प्रति सफल कार्य
Union Alpha
Stealth
76.1
कुल मिलाकर
$0.000
प्रति सफल कार्य
Claude Sonnet 5 xHigh Effort
Anthropic
76.0
कुल मिलाकर
$0.505
प्रति सफल कार्य
Gemini 3.8 Flash High
75.8
कुल मिलाकर
$0.307
प्रति सफल कार्य
Grok 4.5
xAI
75.8
कुल मिलाकर
$0.131
प्रति सफल कार्य
Qwen3.8 27B
खुलाAlibaba
75.3
कुल मिलाकर
$0.094
प्रति सफल कार्य
Muse Spark 1.1 xHigh Effort
Meta
75.3
कुल मिलाकर
$0.198
प्रति सफल कार्य
GPT-5.2 High
OpenAI
74.6
कुल मिलाकर
$0.234
प्रति सफल कार्य
Gemini 3.5 Flash High
74.6
कुल मिलाकर
$0.249
प्रति सफल कार्य
Claude 4.6 Opus Thinking High Effort
Anthropic
74.5
कुल मिलाकर
$0.404
प्रति सफल कार्य
DeepSeek V4 Flash 0731
खुलाDeepSeek
74.2
कुल मिलाकर
$0.060
प्रति सफल कार्य
GPT-5.2 Codex
OpenAI
74.0
कुल मिलाकर
$0.187
प्रति सफल कार्य
Gemini 3.6 Flash High
73.6
कुल मिलाकर
$0.235
प्रति सफल कार्य
GPT-5.6 Luna Max Effort
OpenAI
73.6
कुल मिलाकर
$0.169
प्रति सफल कार्य
GLM-5.2
खुलाZ.AI
73.2
कुल मिलाकर
$0.225
प्रति सफल कार्य
Qwen 3.7 Max
Alibaba
73.1
कुल मिलाकर
$0.182
प्रति सफल कार्य
Claude 4.6 Sonnet Thinking Medium Effort
Anthropic
73.0
कुल मिलाकर
$0.306
प्रति सफल कार्य
Claude 4.5 Opus Thinking High Effort
Anthropic
72.6
कुल मिलाकर
$0.610
प्रति सफल कार्य
Inkling xHigh Effort
खुलाThinking Machines
71.9
कुल मिलाकर
$0.310
प्रति सफल कार्य
GLM-5.3 Flash
खुलाZ.AI
71.6
कुल मिलाकर
$0.031
प्रति सफल कार्य
Kimi K2.6 Thinking
खुलाMoonshot AI
70.5
कुल मिलाकर
$0.169
प्रति सफल कार्य
GPT-5.4 Nano xHigh
OpenAI
69.6
कुल मिलाकर
$0.091
प्रति सफल कार्य
ox-alpha-max
Stealth
69.2
कुल मिलाकर
$0.000
प्रति सफल कार्य
Qwen 3.6 Plus
Alibaba
68.9
कुल मिलाकर
$0.227
प्रति सफल कार्य
Kimi K2.7 Code
खुलाMoonshot AI
68.4
कुल मिलाकर
$0.100
प्रति सफल कार्य
Grok Build 0.1
xAI
67.8
कुल मिलाकर
$0.024
प्रति सफल कार्य
Nemotron 3 Ultra 550B A55B
खुलाNVIDIA
67.4
कुल मिलाकर
$0.371
प्रति सफल कार्य
Minimax M3
Minimax
67.3
कुल मिलाकर
$0.060
प्रति सफल कार्य
GPT-5.4 Mini xHigh
OpenAI
66.4
कुल मिलाकर
$0.334
प्रति सफल कार्य
Qwen 3.6 27B
खुलाAlibaba
64.0
कुल मिलाकर
$0.202
प्रति सफल कार्य
Gemini 3.5 Flash-Lite High
63.9
कुल मिलाकर
$0.069
प्रति सफल कार्य
Grok 4.3
xAI
62.3
कुल मिलाकर
$0.061
प्रति सफल कार्य
Cost is the source-provided cost-per-successful-task metric for the selected scope.
These scores say which model is strongest at a set of held-out tasks. They don’t say which one fits your workflow, your budget, or the tools you already pay for — and the cheapest model that clears your bar usually beats the highest scorer.
What changed recently
Dated releases from every major lab, with the vendor's own claims labelled as claims.
OpenWhat it costs to run
Our tool catalogue carries the price we last verified and the date we checked it.
OpenWhat to actually build
A deployment plan picks the stack for one workflow at your budget — models included.
Open