Grok 4.6
Grok 4.5 جیسی ہی $2 / $6 API قیمت۔ xAI کے مطابق Artificial Analysis Intelligence Index پر 61 — GPT-5.6 Sol Max کے برابر، Fable 5 Max سے ایک پوائنٹ پیچھے۔ علمی کام کی جانچ میں مضبوط؛ Terminal-Bench v3 پر 26%۔
Grok 4.6 بریفنگ پڑھیںAI بینچ مارکس
شائع شدہ ماڈل اسکورز کا عملی جائزہ جو تفصیل کھوئے بغیر صلاحیت، زمرہ وار خوبیوں اور چلانے کی لاگت کا موازنہ کرنے میں مدد دیتا ہے۔
تازہ ترین بینچ مارک اور ماڈل اپ ڈیٹس
اس صفحے کا لیڈر بورڈ LiveBench کی 25 جون کی ریلیز ہے، 22 ستمبر 2026 کو دوبارہ حاصل کی گئی۔ اس میں اب Grok 4.7 xHigh اور DeepSeek V4.1 Flash Max Effort شامل ہیں۔ نیچے ماڈل کے نوٹس وینڈرز کے اپنے صفحات سے ہیں، اسی لیبل کے ساتھ۔
Grok 4.5 جیسی ہی $2 / $6 API قیمت۔ xAI کے مطابق Artificial Analysis Intelligence Index پر 61 — GPT-5.6 Sol Max کے برابر، Fable 5 Max سے ایک پوائنٹ پیچھے۔ علمی کام کی جانچ میں مضبوط؛ Terminal-Bench v3 پر 26%۔
Grok 4.6 بریفنگ پڑھیںDeepSeek V4.1 Flash نے 10 ستمبر 2026 کو نئے deepseek-flash API id پر V4 Flash کی جگہ لی، آف پیک $0.15 / $0.60 اور پیک پر $0.30 / $1.20 فی 1M ٹوکنز۔ 14 ستمبر سے V4 Pro کی درخواستیں بھی اسی کی طرف بھیجی جاتی ہیں، اس لیے ابھی ماڈل ids بدل لیں۔ LiveBench اب V4.1 Flash Max Effort کو مجموعی طور پر 81.1 اسکور دیتا ہے۔
اسے ماڈل ٹریکر میں دیکھیںلیڈر بورڈ کی قطاریں صرف شائع شدہ LiveBench ڈیٹا سے آتی ہیں۔ ہم اسکورز گھڑتے نہیں۔
Best overall
Claude Fable 5.1 Max Effort leads this snapshot at 83.4 overall, $1.212 per successful task.
Best value per task
ox-alpha-max runs at $0.000 per successful task and still scores 69.2 overall.
Best open weights
DeepSeek V4.1 Flash Max Effort is the strongest open-weight model here at 81.1 overall — the option you can host yourself.
Best per capability
If your work is mostly one kind of task, these lead their category in this snapshot.
Every number above comes from the 2026-06-25 release dated 2026-06-25, published by a third-party benchmark and reproduced unaltered.
پہلا چارٹ بتاتا ہے کہ “سب سے مضبوط کون ہے”۔ دوسرا اس سوال کا جواب دیتا ہے جس پر آپ کا پیسہ لگتا ہے: ان میں سے کس کی ادائیگی کرنا فائدہ مند ہے۔
لمبا بہتر ہے۔ بارز 100 میں سے مجموعی اسکور دکھاتی ہیں؛ ہر بار کے ساتھ والا عدد درست قدر ہے۔ کسی قطار کو منتخب کریں تاکہ وہ ماڈل نیچے لاگت کے چارٹ میں آ جائے۔
58 میں سے سرفہرست 12 دکھائے جا رہے ہیں۔ ہر ماڈل کے لیے مکمل موازنے کے منظر پر جائیں۔
اوپر زیادہ مضبوط، بائیں زیادہ سستا — اس لیے بہترین خریداریاں اوپر بائیں ہیں۔ نمبر والے نقاط قدر کی سرحد ہیں: اس سے سستا کوئی زیادہ اسکور نہیں کرتا۔ سرمئی نقاط اسکور اور قیمت دونوں میں پیچھے ہیں۔
منتخب
Claude Fable 5.1 Max Effort
Anthropic
#7 · قدر کی سرحد پر۔
بہترین خریداریاں (سب سے سستا ← سب سے مضبوط)
درست اسکور اور لاگت پڑھنے کے لیے کسی نمبر والے نقطے (یا دائیں طرف اس کی قطار) پر ہوور یا ٹیپ کریں۔ تیر والی کلیدیں سب سے سستے سے سب سے مہنگے ماڈل تک لے جاتی ہیں۔
| ماڈل | ادارہ | مجموعی | فی کامیاب کام |
|---|---|---|---|
| Claude Fable 5.1 Max Effort#7 · اپنی قیمت پر بہترین قدر | Anthropic | 83.4 | $1.212 |
| Claude 5.5 Opus Thinking Max Effort#6 · اپنی قیمت پر بہترین قدر | Anthropic | 83.2 | $0.799 |
| Claude Fable 5 Max Effort | Anthropic | 83.0 | $1.439 |
| GPT-6 Astra Max Effort#5 · اپنی قیمت پر بہترین قدر | OpenAI | 82.2 | $0.736 |
| GPT-6.1 Sol Max Effort#4 · اپنی قیمت پر بہترین قدر | OpenAI | 81.6 | $0.142 |
| Muse Spark 1.3 xHigh Effort | Meta | 81.6 | $0.219 |
| DeepSeek V4.1 Flash Max Effort#3 · اپنی قیمت پر بہترین قدر | DeepSeek | 81.1 | $0.029 |
| GPT-5.6 Sol Max Effort | OpenAI | 81.0 | $0.515 |
| GPT-5.5 Thinking xHigh Effort | OpenAI | 80.2 | $0.435 |
| Claude 5 Opus Thinking Max Effort | Anthropic | 80.1 | $0.699 |
| GPT-6 Sol Max Effort | OpenAI | 79.3 | $0.268 |
| Kimi K3 | Moonshot AI | 79.2 | $0.348 |
| Gemini 3.7 Flash High | 78.8 | $0.157 | |
| Qwen 3.8 Max | Alibaba | 78.5 | $0.275 |
| Grok 4.6 xHigh | xAI | 78.0 | $0.207 |
| Muse Spark 1.2 xHigh Effort | Meta | 78.0 | $0.375 |
| GPT-5.4 Thinking xHigh Effort | OpenAI | 78.0 | $0.387 |
| GPT-5.6 Terra Max Effort | OpenAI | 77.9 | $0.352 |
| Claude Sonnet 5.5 xHigh Effort | Anthropic | 77.8 | $0.141 |
| DeepSeek V4 Pro 0813 | DeepSeek | 77.4 | $0.044 |
| Grok 4.7 xHigh | xAI | 77.4 | $0.718 |
| Gemini 3.1 Pro Preview High | 77.0 | $0.286 | |
| DeepSeek V4 Flash Vision Exp | DeepSeek | 76.8 | $0.051 |
| Claude 4.7 Opus Thinking xHigh Effort | Anthropic | 76.5 | $0.528 |
| Qwen 3.8 Flash Next | Alibaba | 76.2 | $0.042 |
| Claude 4.8 Opus Thinking Max Effort | Anthropic | 76.2 | $0.983 |
| GLM-5.3 | Z.AI | 76.1 | $0.450 |
| Claude Sonnet 5 xHigh Effort | Anthropic | 76.0 | $0.505 |
| Grok 4.5 | xAI | 75.8 | $0.131 |
| Gemini 3.8 Flash High | 75.8 | $0.307 | |
| Qwen3.8 27B | Alibaba | 75.3 | $0.094 |
| Muse Spark 1.1 xHigh Effort | Meta | 75.3 | $0.198 |
| GPT-5.2 High | OpenAI | 74.6 | $0.234 |
| Gemini 3.5 Flash High | 74.6 | $0.249 | |
| Claude 4.6 Opus Thinking High Effort | Anthropic | 74.5 | $0.404 |
| DeepSeek V4 Flash 0731 | DeepSeek | 74.2 | $0.060 |
| GPT-5.2 Codex | OpenAI | 74.0 | $0.187 |
| GPT-5.6 Luna Max Effort | OpenAI | 73.6 | $0.169 |
| Gemini 3.6 Flash High | 73.6 | $0.235 | |
| GLM-5.2 | Z.AI | 73.2 | $0.225 |
| Qwen 3.7 Max | Alibaba | 73.1 | $0.182 |
| Claude 4.6 Sonnet Thinking Medium Effort | Anthropic | 73.0 | $0.306 |
| Claude 4.5 Opus Thinking High Effort | Anthropic | 72.6 | $0.610 |
| GPT-6 Luna Max Effort#2 · اپنی قیمت پر بہترین قدر | OpenAI | 72.0 | $0.026 |
| Inkling xHigh Effort | Thinking Machines | 71.9 | $0.310 |
| GLM-5.3 Flash | Z.AI | 71.6 | $0.031 |
| Kimi K2.6 Thinking | Moonshot AI | 70.5 | $0.169 |
| GPT-5.4 Nano xHigh | OpenAI | 69.6 | $0.091 |
| Qwen 3.6 Plus | Alibaba | 68.9 | $0.227 |
| Kimi K2.7 Code | Moonshot AI | 68.4 | $0.100 |
| Grok Build 0.1#1 · اپنی قیمت پر بہترین قدر | xAI | 67.8 | $0.024 |
| Nemotron 3 Ultra 550B A55B | NVIDIA | 67.4 | $0.371 |
| Minimax M3 | Minimax | 67.3 | $0.060 |
| GPT-5.4 Mini xHigh | OpenAI | 66.4 | $0.334 |
| Qwen 3.6 27B | Alibaba | 64.0 | $0.202 |
| Gemini 3.5 Flash-Lite High | 63.9 | $0.069 | |
| Grok 4.3 | xAI | 62.3 | $0.061 |
لیڈر بورڈ سے تین تک ماڈلز چنیں تاکہ ان کے سات زمروں کے اسکورز کا موازنہ ہو۔
ہر ٹریک 0 سے 100 تک ہے۔ زیادہ دائیں زیادہ مضبوط ہے؛ نمایاں عدد اس قطار میں سرفہرست ہے۔
| زمرہ | Claude Fable 5.1 Max Effort | ox-alpha-max | DeepSeek V4.1 Flash Max Effort |
|---|---|---|---|
| استدلال | 91.7 | 76.6 | 86.7 |
| کوڈنگ | 86.4 | 75.8 | 80.0 |
| ایجنٹک کوڈنگ | 66.1 | 52.6 | 77.3 |
| ریاضی | 97.0 | 77.5 | 93.3 |
| ڈیٹا کا تجزیہ | 80.3 | 75.8 | 79.3 |
| زبان | 89.5 | 66.1 | 81.2 |
| ہدایات پر عمل | 73.0 | 60.3 | 70.0 |
ہر زمرے کو ترتیب دیں، فہرست محدود کریں، اور کسی ماڈل کو کھول کر اس کے شائع شدہ ذیلی کاموں کی تفصیل دیکھیں۔
Claude Fable 5.1 Max Effort
Anthropic
83.4
مجموعی
$1.212
فی کامیاب کام
Claude 5.5 Opus Thinking Max Effort
Anthropic
83.2
مجموعی
$0.799
فی کامیاب کام
Claude Fable 5 Max Effort
Anthropic
83.0
مجموعی
$1.439
فی کامیاب کام
GPT-6 Astra Max Effort
OpenAI
82.2
مجموعی
$0.736
فی کامیاب کام
GPT-6.1 Sol Max Effort
OpenAI
81.6
مجموعی
$0.142
فی کامیاب کام
Muse Spark 1.3 xHigh Effort
Meta
81.6
مجموعی
$0.219
فی کامیاب کام
DeepSeek V4.1 Flash Max Effort
کھولیںDeepSeek
81.1
مجموعی
$0.029
فی کامیاب کام
GPT-5.6 Sol Max Effort
OpenAI
81.0
مجموعی
$0.515
فی کامیاب کام
GPT-5.5 Thinking xHigh Effort
OpenAI
80.2
مجموعی
$0.435
فی کامیاب کام
Claude 5 Opus Thinking Max Effort
Anthropic
80.1
مجموعی
$0.699
فی کامیاب کام
GPT-6 Sol Max Effort
OpenAI
79.3
مجموعی
$0.268
فی کامیاب کام
Kimi K3
کھولیںMoonshot AI
79.2
مجموعی
$0.348
فی کامیاب کام
Gemini 3.7 Flash High
78.8
مجموعی
$0.157
فی کامیاب کام
Qwen 3.8 Max
کھولیںAlibaba
78.5
مجموعی
$0.275
فی کامیاب کام
Muse Spark 1.2 xHigh Effort
Meta
78.0
مجموعی
$0.375
فی کامیاب کام
Grok 4.6 xHigh
xAI
78.0
مجموعی
$0.207
فی کامیاب کام
GPT-5.4 Thinking xHigh Effort
OpenAI
78.0
مجموعی
$0.387
فی کامیاب کام
GPT-5.6 Terra Max Effort
OpenAI
77.9
مجموعی
$0.352
فی کامیاب کام
Claude Sonnet 5.5 xHigh Effort
Anthropic
77.8
مجموعی
$0.141
فی کامیاب کام
DeepSeek V4 Pro 0813
کھولیںDeepSeek
77.4
مجموعی
$0.044
فی کامیاب کام
Grok 4.7 xHigh
xAI
77.4
مجموعی
$0.718
فی کامیاب کام
Gemini 3.1 Pro Preview High
77.0
مجموعی
$0.286
فی کامیاب کام
DeepSeek V4 Flash Vision Exp
کھولیںDeepSeek
76.8
مجموعی
$0.051
فی کامیاب کام
Claude 4.7 Opus Thinking xHigh Effort
Anthropic
76.5
مجموعی
$0.528
فی کامیاب کام
Claude 4.8 Opus Thinking Max Effort
Anthropic
76.2
مجموعی
$0.983
فی کامیاب کام
Qwen 3.8 Flash Next
کھولیںAlibaba
76.2
مجموعی
$0.042
فی کامیاب کام
GLM-5.3
کھولیںZ.AI
76.1
مجموعی
$0.450
فی کامیاب کام
Claude Sonnet 5 xHigh Effort
Anthropic
76.0
مجموعی
$0.505
فی کامیاب کام
Grok 4.5
xAI
75.8
مجموعی
$0.131
فی کامیاب کام
Gemini 3.8 Flash High
75.8
مجموعی
$0.307
فی کامیاب کام
Qwen3.8 27B
کھولیںAlibaba
75.3
مجموعی
$0.094
فی کامیاب کام
Muse Spark 1.1 xHigh Effort
Meta
75.3
مجموعی
$0.198
فی کامیاب کام
GPT-5.2 High
OpenAI
74.6
مجموعی
$0.234
فی کامیاب کام
Gemini 3.5 Flash High
74.6
مجموعی
$0.249
فی کامیاب کام
Claude 4.6 Opus Thinking High Effort
Anthropic
74.5
مجموعی
$0.404
فی کامیاب کام
DeepSeek V4 Flash 0731
کھولیںDeepSeek
74.2
مجموعی
$0.060
فی کامیاب کام
GPT-5.2 Codex
OpenAI
74.0
مجموعی
$0.187
فی کامیاب کام
GPT-5.6 Luna Max Effort
OpenAI
73.6
مجموعی
$0.169
فی کامیاب کام
Gemini 3.6 Flash High
73.6
مجموعی
$0.235
فی کامیاب کام
GLM-5.2
کھولیںZ.AI
73.2
مجموعی
$0.225
فی کامیاب کام
Qwen 3.7 Max
Alibaba
73.1
مجموعی
$0.182
فی کامیاب کام
Claude 4.6 Sonnet Thinking Medium Effort
Anthropic
73.0
مجموعی
$0.306
فی کامیاب کام
Claude 4.5 Opus Thinking High Effort
Anthropic
72.6
مجموعی
$0.610
فی کامیاب کام
GPT-6 Luna Max Effort
OpenAI
72.0
مجموعی
$0.026
فی کامیاب کام
Inkling xHigh Effort
کھولیںThinking Machines
71.9
مجموعی
$0.310
فی کامیاب کام
GLM-5.3 Flash
کھولیںZ.AI
71.6
مجموعی
$0.031
فی کامیاب کام
Kimi K2.6 Thinking
کھولیںMoonshot AI
70.5
مجموعی
$0.169
فی کامیاب کام
GPT-5.4 Nano xHigh
OpenAI
69.6
مجموعی
$0.091
فی کامیاب کام
ox-alpha-max
Stealth
69.2
مجموعی
$0.000
فی کامیاب کام
Qwen 3.6 Plus
Alibaba
68.9
مجموعی
$0.227
فی کامیاب کام
Kimi K2.7 Code
کھولیںMoonshot AI
68.4
مجموعی
$0.100
فی کامیاب کام
Grok Build 0.1
xAI
67.8
مجموعی
$0.024
فی کامیاب کام
Nemotron 3 Ultra 550B A55B
کھولیںNVIDIA
67.4
مجموعی
$0.371
فی کامیاب کام
Minimax M3
Minimax
67.3
مجموعی
$0.060
فی کامیاب کام
GPT-5.4 Mini xHigh
OpenAI
66.4
مجموعی
$0.334
فی کامیاب کام
Qwen 3.6 27B
کھولیںAlibaba
64.0
مجموعی
$0.202
فی کامیاب کام
Gemini 3.5 Flash-Lite High
63.9
مجموعی
$0.069
فی کامیاب کام
Grok 4.3
xAI
62.3
مجموعی
$0.061
فی کامیاب کام
لاگت منتخب دائرے کے لیے ماخذ کی فراہم کردہ فی کامیاب کام لاگت کا پیمانہ ہے۔
These scores say which model is strongest at a set of held-out tasks. They don’t say which one fits your workflow, your budget, or the tools you already pay for — and the cheapest model that clears your bar usually beats the highest scorer.
What changed recently
Dated releases from every major lab, with the vendor's own claims labelled as claims.
OpenWhat it costs to run
Our tool catalogue carries the price we last verified and the date we checked it.
OpenWhat to actually build
A deployment plan picks the stack for one workflow at your budget — models included.
Open