Grok 4.6
Same $2 / $6 API price as Grok 4.5. xAI reports an Artificial Analysis Intelligence Index of 61 — tied with GPT-5.6 Sol Max, one point behind Fable 5 Max. Strong on knowledge-work evals; 26% on Terminal-Bench v3.
Read the Grok 4.6 briefingAI-бенчмарки
A practical view of published model scores that helps you compare capability, category strengths, and run cost without losing the detail.
Latest benchmark & model updates
The leaderboard on this page is LiveBench's 25 June release, re-captured on 22 September 2026. It now includes Grok 4.7 xHigh and DeepSeek V4.1 Flash Max Effort. The model notes below are from the vendors' own pages, labelled as such.
Same $2 / $6 API price as Grok 4.5. xAI reports an Artificial Analysis Intelligence Index of 61 — tied with GPT-5.6 Sol Max, one point behind Fable 5 Max. Strong on knowledge-work evals; 26% on Terminal-Bench v3.
Read the Grok 4.6 briefingDeepSeek V4.1 Flash replaced V4 Flash on 10 Sep 2026 on the new deepseek-flash API id, at $0.15 / $0.60 per 1M tokens off-peak and $0.30 / $1.20 at peak. From 14 Sep, V4 Pro requests are routed to it too, so switch model ids now. LiveBench now scores V4.1 Flash Max Effort at 81.1 overall.
See it in the model trackerLeaderboard rows come only from published LiveBench data. We do not invent scores.
Best overall
Claude Fable 5.1 Max Effort leads this snapshot at 83.4 overall, $1.212 per successful task.
Best value per task
Union Alpha runs at $0.000 per successful task and still scores 76.1 overall.
Best open weights
DeepSeek V4.1 Flash Max Effort is the strongest open-weight model here at 81.1 overall — the option you can host yourself.
Best per capability
If your work is mostly one kind of task, these lead their category in this snapshot.
Every number above comes from the 2026-06-25 release dated 2026-06-25, published by a third-party benchmark and reproduced unaltered.
Первый график отвечает на вопрос «кто самый сильный». Второй отвечает на вопрос, который действительно стоит вам денег: за кого из них стоит платить.
Длиннее — лучше. Столбцы показывают оценку Общий из 100; цифра рядом с каждым столбцом — точное значение. Выберите строку, чтобы перенести эту модель на график стоимости ниже.
Показаны первые 12 из 54. Переключитесь на полное сравнение, чтобы увидеть все модели.
Чем выше — тем сильнее, чем левее — тем дешевле, поэтому лучшие покупки находятся вверху слева. Ступенчатая линия соединяет модели, которые ничто более дешёвое не превосходит; всё, что ниже, проигрывает чему-то, что стоит меньше.
Selected
Claude Fable 5.1 Max Effort
Anthropic
#5 · На фронтире ценности.
Best buys (cheapest → strongest)
Перейдите на график с помощью Tab, затем используйте стрелки для перемещения по моделям от самых дешёвых к самым дорогим.
| Модель | Организация | Общий | за успешно выполненную задачу |
|---|---|---|---|
| Claude Fable 5.1 Max Effort#5 · Лучшая ценность за свою цену | Anthropic | 83.4 | 1,212 $ |
| Claude Fable 5 Max Effort | Anthropic | 83.0 | 1,439 $ |
| GPT-6 Astra Max Effort#4 · Лучшая ценность за свою цену | OpenAI | 82.2 | 0,736 $ |
| Muse Spark 1.3 xHigh Effort#3 · Лучшая ценность за свою цену | Meta | 81.6 | 0,219 $ |
| DeepSeek V4.1 Flash Max Effort#2 · Лучшая ценность за свою цену | DeepSeek | 81.1 | 0,029 $ |
| GPT-5.6 Sol Max Effort | OpenAI | 81.0 | 0,515 $ |
| GPT-5.5 Thinking xHigh Effort | OpenAI | 80.2 | 0,435 $ |
| Claude 5 Opus Thinking Max Effort | Anthropic | 80.1 | 0,699 $ |
| Kimi K3 | Moonshot AI | 79.2 | 0,348 $ |
| Gemini 3.7 Flash High | 78.8 | 0,157 $ | |
| Qwen 3.8 Max | Alibaba | 78.5 | 0,275 $ |
| Grok 4.6 | xAI | 78.0 | 0,207 $ |
| Muse Spark 1.2 xHigh Effort | Meta | 78.0 | 0,375 $ |
| GPT-5.4 Thinking xHigh Effort | OpenAI | 78.0 | 0,387 $ |
| GPT-5.6 Terra Max Effort | OpenAI | 77.9 | 0,352 $ |
| DeepSeek V4 Pro 0813 | DeepSeek | 77.4 | 0,044 $ |
| Grok 4.7 xHigh | xAI | 77.4 | 0,718 $ |
| Gemini 3.1 Pro Preview High | 77.0 | 0,286 $ | |
| DeepSeek V4 Flash Vision Exp | DeepSeek | 76.8 | 0,051 $ |
| Claude 4.7 Opus Thinking xHigh Effort | Anthropic | 76.5 | 0,528 $ |
| Qwen 3.8 Flash Next | Alibaba | 76.2 | 0,042 $ |
| Claude 4.8 Opus Thinking Max Effort | Anthropic | 76.2 | 0,983 $ |
| GLM-5.3 | Z.AI | 76.1 | 0,450 $ |
| Claude Sonnet 5 xHigh Effort | Anthropic | 76.0 | 0,505 $ |
| Grok 4.5 | xAI | 75.8 | 0,131 $ |
| Gemini 3.8 Flash High | 75.8 | 0,307 $ | |
| Qwen3.8 27B | Alibaba | 75.3 | 0,094 $ |
| Muse Spark 1.1 xHigh Effort | Meta | 75.3 | 0,198 $ |
| GPT-5.2 High | OpenAI | 74.6 | 0,234 $ |
| Gemini 3.5 Flash High | 74.6 | 0,249 $ | |
| Claude 4.6 Opus Thinking High Effort | Anthropic | 74.5 | 0,404 $ |
| DeepSeek V4 Flash 0731 | DeepSeek | 74.2 | 0,060 $ |
| GPT-5.2 Codex | OpenAI | 74.0 | 0,187 $ |
| GPT-5.6 Luna Max Effort | OpenAI | 73.6 | 0,169 $ |
| Gemini 3.6 Flash High | 73.6 | 0,235 $ | |
| GLM-5.2 | Z.AI | 73.2 | 0,225 $ |
| Qwen 3.7 Max | Alibaba | 73.1 | 0,182 $ |
| Claude 4.6 Sonnet Thinking Medium Effort | Anthropic | 73.0 | 0,306 $ |
| Claude 4.5 Opus Thinking High Effort | Anthropic | 72.6 | 0,610 $ |
| Inkling xHigh Effort | Thinking Machines | 71.9 | 0,310 $ |
| GLM-5.3 Flash | Z.AI | 71.6 | 0,031 $ |
| Kimi K2.6 Thinking | Moonshot AI | 70.5 | 0,169 $ |
| GPT-5.4 Nano xHigh | OpenAI | 69.6 | 0,091 $ |
| Qwen 3.6 Plus | Alibaba | 68.9 | 0,227 $ |
| Kimi K2.7 Code | Moonshot AI | 68.4 | 0,100 $ |
| Grok Build 0.1#1 · Лучшая ценность за свою цену | xAI | 67.8 | 0,024 $ |
| Nemotron 3 Ultra 550B A55B | NVIDIA | 67.4 | 0,371 $ |
| Minimax M3 | Minimax | 67.3 | 0,060 $ |
| GPT-5.4 Mini xHigh | OpenAI | 66.4 | 0,334 $ |
| Qwen 3.6 27B | Alibaba | 64.0 | 0,202 $ |
| Gemini 3.5 Flash-Lite High | 63.9 | 0,069 $ | |
| Grok 4.3 | xAI | 62.3 | 0,061 $ |
Выберите до трех моделей из таблицы лидеров, чтобы сравнить их оценки по семи категориям.
Каждая шкала от 0 до 100. Правее — сильнее; жирная цифра — лидер в этой строке.
| Категория | Claude Fable 5.1 Max Effort | Union Alpha | DeepSeek V4.1 Flash Max Effort |
|---|---|---|---|
| Рассуждение | 91.7 | 80.8 | 86.7 |
| Программирование | 86.4 | 82.1 | 80.0 |
| Агентное программирование | 66.1 | 54.7 | 77.3 |
| Математика | 97.0 | 95.3 | 93.3 |
| Анализ данных | 80.3 | 74.6 | 79.3 |
| Язык | 89.5 | 85.9 | 81.2 |
| Следование инструкциям | 73.0 | 59.5 | 70.0 |
Сортируйте по каждой категории, сужайте список и открывайте модель, чтобы увидеть разбивку по опубликованным подзадачам.
Claude Fable 5.1 Max Effort
Anthropic
83.4
Общий
1,212 $
за успешно выполненную задачу
Claude Fable 5 Max Effort
Anthropic
83.0
Общий
1,439 $
за успешно выполненную задачу
GPT-6 Astra Max Effort
OpenAI
82.2
Общий
0,736 $
за успешно выполненную задачу
Muse Spark 1.3 xHigh Effort
Meta
81.6
Общий
0,219 $
за успешно выполненную задачу
DeepSeek V4.1 Flash Max Effort
ОткрытыеDeepSeek
81.1
Общий
0,029 $
за успешно выполненную задачу
GPT-5.6 Sol Max Effort
OpenAI
81.0
Общий
0,515 $
за успешно выполненную задачу
GPT-5.5 Thinking xHigh Effort
OpenAI
80.2
Общий
0,435 $
за успешно выполненную задачу
Claude 5 Opus Thinking Max Effort
Anthropic
80.1
Общий
0,699 $
за успешно выполненную задачу
Kimi K3
ОткрытыеMoonshot AI
79.2
Общий
0,348 $
за успешно выполненную задачу
Gemini 3.7 Flash High
78.8
Общий
0,157 $
за успешно выполненную задачу
Qwen 3.8 Max
ОткрытыеAlibaba
78.5
Общий
0,275 $
за успешно выполненную задачу
Muse Spark 1.2 xHigh Effort
Meta
78.0
Общий
0,375 $
за успешно выполненную задачу
GPT-5.4 Thinking xHigh Effort
OpenAI
78.0
Общий
0,387 $
за успешно выполненную задачу
Grok 4.6
xAI
78.0
Общий
0,207 $
за успешно выполненную задачу
GPT-5.6 Terra Max Effort
OpenAI
77.9
Общий
0,352 $
за успешно выполненную задачу
DeepSeek V4 Pro 0813
ОткрытыеDeepSeek
77.4
Общий
0,044 $
за успешно выполненную задачу
Grok 4.7 xHigh
xAI
77.4
Общий
0,718 $
за успешно выполненную задачу
Gemini 3.1 Pro Preview High
77.0
Общий
0,286 $
за успешно выполненную задачу
DeepSeek V4 Flash Vision Exp
ОткрытыеDeepSeek
76.8
Общий
0,051 $
за успешно выполненную задачу
Claude 4.7 Opus Thinking xHigh Effort
Anthropic
76.5
Общий
0,528 $
за успешно выполненную задачу
Qwen 3.8 Flash Next
ОткрытыеAlibaba
76.2
Общий
0,042 $
за успешно выполненную задачу
Claude 4.8 Opus Thinking Max Effort
Anthropic
76.2
Общий
0,983 $
за успешно выполненную задачу
GLM-5.3
ОткрытыеZ.AI
76.1
Общий
0,450 $
за успешно выполненную задачу
Union Alpha
Stealth
76.1
Общий
0,000 $
за успешно выполненную задачу
Claude Sonnet 5 xHigh Effort
Anthropic
76.0
Общий
0,505 $
за успешно выполненную задачу
Gemini 3.8 Flash High
75.8
Общий
0,307 $
за успешно выполненную задачу
Grok 4.5
xAI
75.8
Общий
0,131 $
за успешно выполненную задачу
Qwen3.8 27B
ОткрытыеAlibaba
75.3
Общий
0,094 $
за успешно выполненную задачу
Muse Spark 1.1 xHigh Effort
Meta
75.3
Общий
0,198 $
за успешно выполненную задачу
GPT-5.2 High
OpenAI
74.6
Общий
0,234 $
за успешно выполненную задачу
Gemini 3.5 Flash High
74.6
Общий
0,249 $
за успешно выполненную задачу
Claude 4.6 Opus Thinking High Effort
Anthropic
74.5
Общий
0,404 $
за успешно выполненную задачу
DeepSeek V4 Flash 0731
ОткрытыеDeepSeek
74.2
Общий
0,060 $
за успешно выполненную задачу
GPT-5.2 Codex
OpenAI
74.0
Общий
0,187 $
за успешно выполненную задачу
Gemini 3.6 Flash High
73.6
Общий
0,235 $
за успешно выполненную задачу
GPT-5.6 Luna Max Effort
OpenAI
73.6
Общий
0,169 $
за успешно выполненную задачу
GLM-5.2
ОткрытыеZ.AI
73.2
Общий
0,225 $
за успешно выполненную задачу
Qwen 3.7 Max
Alibaba
73.1
Общий
0,182 $
за успешно выполненную задачу
Claude 4.6 Sonnet Thinking Medium Effort
Anthropic
73.0
Общий
0,306 $
за успешно выполненную задачу
Claude 4.5 Opus Thinking High Effort
Anthropic
72.6
Общий
0,610 $
за успешно выполненную задачу
Inkling xHigh Effort
ОткрытыеThinking Machines
71.9
Общий
0,310 $
за успешно выполненную задачу
GLM-5.3 Flash
ОткрытыеZ.AI
71.6
Общий
0,031 $
за успешно выполненную задачу
Kimi K2.6 Thinking
ОткрытыеMoonshot AI
70.5
Общий
0,169 $
за успешно выполненную задачу
GPT-5.4 Nano xHigh
OpenAI
69.6
Общий
0,091 $
за успешно выполненную задачу
ox-alpha-max
Stealth
69.2
Общий
0,000 $
за успешно выполненную задачу
Qwen 3.6 Plus
Alibaba
68.9
Общий
0,227 $
за успешно выполненную задачу
Kimi K2.7 Code
ОткрытыеMoonshot AI
68.4
Общий
0,100 $
за успешно выполненную задачу
Grok Build 0.1
xAI
67.8
Общий
0,024 $
за успешно выполненную задачу
Nemotron 3 Ultra 550B A55B
ОткрытыеNVIDIA
67.4
Общий
0,371 $
за успешно выполненную задачу
Minimax M3
Minimax
67.3
Общий
0,060 $
за успешно выполненную задачу
GPT-5.4 Mini xHigh
OpenAI
66.4
Общий
0,334 $
за успешно выполненную задачу
Qwen 3.6 27B
ОткрытыеAlibaba
64.0
Общий
0,202 $
за успешно выполненную задачу
Gemini 3.5 Flash-Lite High
63.9
Общий
0,069 $
за успешно выполненную задачу
Grok 4.3
xAI
62.3
Общий
0,061 $
за успешно выполненную задачу
Cost is the source-provided cost-per-successful-task metric for the selected scope.
These scores say which model is strongest at a set of held-out tasks. They don’t say which one fits your workflow, your budget, or the tools you already pay for — and the cheapest model that clears your bar usually beats the highest scorer.
What changed recently
Dated releases from every major lab, with the vendor's own claims labelled as claims.
OpenWhat it costs to run
Our tool catalogue carries the price we last verified and the date we checked it.
OpenWhat to actually build
A deployment plan picks the stack for one workflow at your budget — models included.
Open