Grok 4.6
API 價格與 Grok 4.5 相同,皆為 $2 / $6。xAI 公布的 Artificial Analysis Intelligence Index 為 61 — 與 GPT-5.6 Sol Max 並列,比 Fable 5 Max 低一分。在知識工作評測中表現強勁;在 Terminal-Bench v3 上為 26%。
閱讀 Grok 4.6 簡報最新基準測試與模型更新
本頁的排行榜是 LiveBench 於 6 月 25 日的發布版本,已於 2026 年 9 月 22 日重新擷取。目前已納入 Grok 4.7 xHigh 與 DeepSeek V4.1 Flash Max Effort。下方的模型說明取自各供應商自己的頁面,並已如此標示。
API 價格與 Grok 4.5 相同,皆為 $2 / $6。xAI 公布的 Artificial Analysis Intelligence Index 為 61 — 與 GPT-5.6 Sol Max 並列,比 Fable 5 Max 低一分。在知識工作評測中表現強勁;在 Terminal-Bench v3 上為 26%。
閱讀 Grok 4.6 簡報DeepSeek V4.1 Flash 於 2026 年 9 月 10 日取代 V4 Flash,改用全新的 deepseek-flash API ID;離峰時段每 100 萬 tokens 為 $0.15 / $0.60,尖峰時段為 $0.30 / $1.20。從 9 月 14 日起,V4 Pro 的請求也會轉送至此模型,因此請立即切換模型 ID。LiveBench 目前將 V4.1 Flash Max Effort 的綜合分數評為 81.1。
在模型追蹤中查看排行榜的列僅來自已發布的 LiveBench 數據。我們不會虛構分數。
Best overall
Claude Fable 5.1 Max Effort leads this snapshot at 83.4 overall, $1.212 per successful task.
Best value per task
ox-alpha-max runs at $0.000 per successful task and still scores 69.2 overall.
Best open weights
DeepSeek V4.1 Flash Max Effort is the strongest open-weight model here at 81.1 overall — the option you can host yourself.
Best per capability
If your work is mostly one kind of task, these lead their category in this snapshot.
Every number above comes from the 2026-06-25 release dated 2026-06-25, published by a third-party benchmark and reproduced unaltered.
第一張圖回答「誰最強」。第二張圖回答真正會讓你花錢的問題:其中哪一個值得付費。
越長越好。長條顯示滿分 100 的 綜合 分數;每個長條旁的數字為精確數值。選取某一列,即可將該模型帶入下方的成本圖表。
顯示前 12 名,共 58 名。切換至完整比較檢視,即可查看所有模型。
越高越強,越左越便宜 — 因此最佳選擇位於左上方。編號的點為價值前緣:沒有更便宜又得分更高的模型。灰色的點在分數與價格上都被超越。
已選取
Claude Fable 5.1 Max Effort
Anthropic
#7 · 位於價值前緣。
最佳選擇(由便宜到最強)
將滑鼠移到或點選編號的點(或右側對應的列),即可讀取精確的分數與成本。方向鍵可讓你依由便宜到昂貴的順序逐一瀏覽模型。
| 模型 | 機構 | 綜合 | 每次成功任務 |
|---|---|---|---|
| Claude Fable 5.1 Max Effort#7 · 同價位中的最佳價值 | Anthropic | 83.4 | US$1.212 |
| Claude 5.5 Opus Thinking Max Effort#6 · 同價位中的最佳價值 | Anthropic | 83.2 | US$0.799 |
| Claude Fable 5 Max Effort | Anthropic | 83.0 | US$1.439 |
| GPT-6 Astra Max Effort#5 · 同價位中的最佳價值 | OpenAI | 82.2 | US$0.736 |
| GPT-6.1 Sol Max Effort#4 · 同價位中的最佳價值 | OpenAI | 81.6 | US$0.142 |
| Muse Spark 1.3 xHigh Effort | Meta | 81.6 | US$0.219 |
| DeepSeek V4.1 Flash Max Effort#3 · 同價位中的最佳價值 | DeepSeek | 81.1 | US$0.029 |
| GPT-5.6 Sol Max Effort | OpenAI | 81.0 | US$0.515 |
| GPT-5.5 Thinking xHigh Effort | OpenAI | 80.2 | US$0.435 |
| Claude 5 Opus Thinking Max Effort | Anthropic | 80.1 | US$0.699 |
| GPT-6 Sol Max Effort | OpenAI | 79.3 | US$0.268 |
| Kimi K3 | Moonshot AI | 79.2 | US$0.348 |
| Gemini 3.7 Flash High | 78.8 | US$0.157 | |
| Qwen 3.8 Max | Alibaba | 78.5 | US$0.275 |
| Grok 4.6 xHigh | xAI | 78.0 | US$0.207 |
| Muse Spark 1.2 xHigh Effort | Meta | 78.0 | US$0.375 |
| GPT-5.4 Thinking xHigh Effort | OpenAI | 78.0 | US$0.387 |
| GPT-5.6 Terra Max Effort | OpenAI | 77.9 | US$0.352 |
| Claude Sonnet 5.5 xHigh Effort | Anthropic | 77.8 | US$0.141 |
| DeepSeek V4 Pro 0813 | DeepSeek | 77.4 | US$0.044 |
| Grok 4.7 xHigh | xAI | 77.4 | US$0.718 |
| Gemini 3.1 Pro Preview High | 77.0 | US$0.286 | |
| DeepSeek V4 Flash Vision Exp | DeepSeek | 76.8 | US$0.051 |
| Claude 4.7 Opus Thinking xHigh Effort | Anthropic | 76.5 | US$0.528 |
| Qwen 3.8 Flash Next | Alibaba | 76.2 | US$0.042 |
| Claude 4.8 Opus Thinking Max Effort | Anthropic | 76.2 | US$0.983 |
| GLM-5.3 | Z.AI | 76.1 | US$0.450 |
| Claude Sonnet 5 xHigh Effort | Anthropic | 76.0 | US$0.505 |
| Grok 4.5 | xAI | 75.8 | US$0.131 |
| Gemini 3.8 Flash High | 75.8 | US$0.307 | |
| Qwen3.8 27B | Alibaba | 75.3 | US$0.094 |
| Muse Spark 1.1 xHigh Effort | Meta | 75.3 | US$0.198 |
| GPT-5.2 High | OpenAI | 74.6 | US$0.234 |
| Gemini 3.5 Flash High | 74.6 | US$0.249 | |
| Claude 4.6 Opus Thinking High Effort | Anthropic | 74.5 | US$0.404 |
| DeepSeek V4 Flash 0731 | DeepSeek | 74.2 | US$0.060 |
| GPT-5.2 Codex | OpenAI | 74.0 | US$0.187 |
| GPT-5.6 Luna Max Effort | OpenAI | 73.6 | US$0.169 |
| Gemini 3.6 Flash High | 73.6 | US$0.235 | |
| GLM-5.2 | Z.AI | 73.2 | US$0.225 |
| Qwen 3.7 Max | Alibaba | 73.1 | US$0.182 |
| Claude 4.6 Sonnet Thinking Medium Effort | Anthropic | 73.0 | US$0.306 |
| Claude 4.5 Opus Thinking High Effort | Anthropic | 72.6 | US$0.610 |
| GPT-6 Luna Max Effort#2 · 同價位中的最佳價值 | OpenAI | 72.0 | US$0.026 |
| Inkling xHigh Effort | Thinking Machines | 71.9 | US$0.310 |
| GLM-5.3 Flash | Z.AI | 71.6 | US$0.031 |
| Kimi K2.6 Thinking | Moonshot AI | 70.5 | US$0.169 |
| GPT-5.4 Nano xHigh | OpenAI | 69.6 | US$0.091 |
| Qwen 3.6 Plus | Alibaba | 68.9 | US$0.227 |
| Kimi K2.7 Code | Moonshot AI | 68.4 | US$0.100 |
| Grok Build 0.1#1 · 同價位中的最佳價值 | xAI | 67.8 | US$0.024 |
| Nemotron 3 Ultra 550B A55B | NVIDIA | 67.4 | US$0.371 |
| Minimax M3 | Minimax | 67.3 | US$0.060 |
| GPT-5.4 Mini xHigh | OpenAI | 66.4 | US$0.334 |
| Qwen 3.6 27B | Alibaba | 64.0 | US$0.202 |
| Gemini 3.5 Flash-Lite High | 63.9 | US$0.069 | |
| Grok 4.3 | xAI | 62.3 | US$0.061 |
從排行榜中最多選擇三個模型,比較它們的七個類別分數。
每條軸皆為 0 到 100。越靠右越強;粗體數字為該列的領先者。
| 類別 | Claude Fable 5.1 Max Effort | ox-alpha-max | DeepSeek V4.1 Flash Max Effort |
|---|---|---|---|
| 推理 | 91.7 | 76.6 | 86.7 |
| 程式設計 | 86.4 | 75.8 | 80.0 |
| 代理式程式設計 | 66.1 | 52.6 | 77.3 |
| 數學 | 97.0 | 77.5 | 93.3 |
| 資料分析 | 80.3 | 75.8 | 79.3 |
| 語言 | 89.5 | 66.1 | 81.2 |
| 指令遵循 | 73.0 | 60.3 | 70.0 |
排序每個類別、縮小清單範圍,並開啟模型查看其公開的子任務細項。
Claude Fable 5.1 Max Effort
Anthropic
83.4
綜合
US$1.212
每次成功任務
Claude 5.5 Opus Thinking Max Effort
Anthropic
83.2
綜合
US$0.799
每次成功任務
Claude Fable 5 Max Effort
Anthropic
83.0
綜合
US$1.439
每次成功任務
GPT-6 Astra Max Effort
OpenAI
82.2
綜合
US$0.736
每次成功任務
GPT-6.1 Sol Max Effort
OpenAI
81.6
綜合
US$0.142
每次成功任務
Muse Spark 1.3 xHigh Effort
Meta
81.6
綜合
US$0.219
每次成功任務
DeepSeek V4.1 Flash Max Effort
開放DeepSeek
81.1
綜合
US$0.029
每次成功任務
GPT-5.6 Sol Max Effort
OpenAI
81.0
綜合
US$0.515
每次成功任務
GPT-5.5 Thinking xHigh Effort
OpenAI
80.2
綜合
US$0.435
每次成功任務
Claude 5 Opus Thinking Max Effort
Anthropic
80.1
綜合
US$0.699
每次成功任務
GPT-6 Sol Max Effort
OpenAI
79.3
綜合
US$0.268
每次成功任務
Kimi K3
開放Moonshot AI
79.2
綜合
US$0.348
每次成功任務
Gemini 3.7 Flash High
78.8
綜合
US$0.157
每次成功任務
Qwen 3.8 Max
開放Alibaba
78.5
綜合
US$0.275
每次成功任務
Muse Spark 1.2 xHigh Effort
Meta
78.0
綜合
US$0.375
每次成功任務
Grok 4.6 xHigh
xAI
78.0
綜合
US$0.207
每次成功任務
GPT-5.4 Thinking xHigh Effort
OpenAI
78.0
綜合
US$0.387
每次成功任務
GPT-5.6 Terra Max Effort
OpenAI
77.9
綜合
US$0.352
每次成功任務
Claude Sonnet 5.5 xHigh Effort
Anthropic
77.8
綜合
US$0.141
每次成功任務
DeepSeek V4 Pro 0813
開放DeepSeek
77.4
綜合
US$0.044
每次成功任務
Grok 4.7 xHigh
xAI
77.4
綜合
US$0.718
每次成功任務
Gemini 3.1 Pro Preview High
77.0
綜合
US$0.286
每次成功任務
DeepSeek V4 Flash Vision Exp
開放DeepSeek
76.8
綜合
US$0.051
每次成功任務
Claude 4.7 Opus Thinking xHigh Effort
Anthropic
76.5
綜合
US$0.528
每次成功任務
Claude 4.8 Opus Thinking Max Effort
Anthropic
76.2
綜合
US$0.983
每次成功任務
Qwen 3.8 Flash Next
開放Alibaba
76.2
綜合
US$0.042
每次成功任務
GLM-5.3
開放Z.AI
76.1
綜合
US$0.450
每次成功任務
Claude Sonnet 5 xHigh Effort
Anthropic
76.0
綜合
US$0.505
每次成功任務
Grok 4.5
xAI
75.8
綜合
US$0.131
每次成功任務
Gemini 3.8 Flash High
75.8
綜合
US$0.307
每次成功任務
Qwen3.8 27B
開放Alibaba
75.3
綜合
US$0.094
每次成功任務
Muse Spark 1.1 xHigh Effort
Meta
75.3
綜合
US$0.198
每次成功任務
GPT-5.2 High
OpenAI
74.6
綜合
US$0.234
每次成功任務
Gemini 3.5 Flash High
74.6
綜合
US$0.249
每次成功任務
Claude 4.6 Opus Thinking High Effort
Anthropic
74.5
綜合
US$0.404
每次成功任務
DeepSeek V4 Flash 0731
開放DeepSeek
74.2
綜合
US$0.060
每次成功任務
GPT-5.2 Codex
OpenAI
74.0
綜合
US$0.187
每次成功任務
GPT-5.6 Luna Max Effort
OpenAI
73.6
綜合
US$0.169
每次成功任務
Gemini 3.6 Flash High
73.6
綜合
US$0.235
每次成功任務
GLM-5.2
開放Z.AI
73.2
綜合
US$0.225
每次成功任務
Qwen 3.7 Max
Alibaba
73.1
綜合
US$0.182
每次成功任務
Claude 4.6 Sonnet Thinking Medium Effort
Anthropic
73.0
綜合
US$0.306
每次成功任務
Claude 4.5 Opus Thinking High Effort
Anthropic
72.6
綜合
US$0.610
每次成功任務
GPT-6 Luna Max Effort
OpenAI
72.0
綜合
US$0.026
每次成功任務
Inkling xHigh Effort
開放Thinking Machines
71.9
綜合
US$0.310
每次成功任務
GLM-5.3 Flash
開放Z.AI
71.6
綜合
US$0.031
每次成功任務
Kimi K2.6 Thinking
開放Moonshot AI
70.5
綜合
US$0.169
每次成功任務
GPT-5.4 Nano xHigh
OpenAI
69.6
綜合
US$0.091
每次成功任務
ox-alpha-max
Stealth
69.2
綜合
US$0.000
每次成功任務
Qwen 3.6 Plus
Alibaba
68.9
綜合
US$0.227
每次成功任務
Kimi K2.7 Code
開放Moonshot AI
68.4
綜合
US$0.100
每次成功任務
Grok Build 0.1
xAI
67.8
綜合
US$0.024
每次成功任務
Nemotron 3 Ultra 550B A55B
開放NVIDIA
67.4
綜合
US$0.371
每次成功任務
Minimax M3
Minimax
67.3
綜合
US$0.060
每次成功任務
GPT-5.4 Mini xHigh
OpenAI
66.4
綜合
US$0.334
每次成功任務
Qwen 3.6 27B
開放Alibaba
64.0
綜合
US$0.202
每次成功任務
Gemini 3.5 Flash-Lite High
63.9
綜合
US$0.069
每次成功任務
Grok 4.3
xAI
62.3
綜合
US$0.061
每次成功任務
成本為所選範圍中,來源提供的「每次成功任務成本」指標。
These scores say which model is strongest at a set of held-out tasks. They don’t say which one fits your workflow, your budget, or the tools you already pay for — and the cheapest model that clears your bar usually beats the highest scorer.
What changed recently
Dated releases from every major lab, with the vendor's own claims labelled as claims.
OpenWhat it costs to run
Our tool catalogue carries the price we last verified and the date we checked it.
OpenWhat to actually build
A deployment plan picks the stack for one workflow at your budget — models included.
Open