Grok 4.6
אותו מחיר API של $2 / $6 כמו Grok 4.5. xAI מדווחת על Artificial Analysis Intelligence Index של 61 — שוויון עם GPT-5.6 Sol Max, נקודה אחת מאחורי Fable 5 Max. חזק במבחני עבודת ידע; 26% ב-Terminal-Bench v3.
קראו את התדריך על Grok 4.6מדדי ביצועים של AI
מבט מעשי על ציוני מודלים שפורסמו, שעוזר להשוות יכולות, חוזקות לפי קטגוריה ועלות הרצה בלי לאבד את הפרטים.
עדכוני מדדי ביצועים ומודלים אחרונים
טבלת הדירוג בדף הזה היא גרסת 25 ביוני של LiveBench, שנלכדה מחדש ב-22 בספטמבר 2026. היא כוללת כעת את Grok 4.7 xHigh ואת DeepSeek V4.1 Flash Max Effort. הערות המודלים למטה לקוחות מהדפים של הספקים עצמם, ומסומנות ככאלה.
אותו מחיר API של $2 / $6 כמו Grok 4.5. xAI מדווחת על Artificial Analysis Intelligence Index של 61 — שוויון עם GPT-5.6 Sol Max, נקודה אחת מאחורי Fable 5 Max. חזק במבחני עבודת ידע; 26% ב-Terminal-Bench v3.
קראו את התדריך על Grok 4.6DeepSeek V4.1 Flash החליף את V4 Flash ב-10 בספטמבר 2026 תחת מזהה ה-API החדש deepseek-flash, ב-$0.15 / $0.60 לכל מיליון טוקנים בשעות שפל וב-$0.30 / $1.20 בשעות שיא. מ-14 בספטמבר, גם בקשות ל-V4 Pro מנותבות אליו, אז החליפו מזהי מודל עכשיו. LiveBench מדרג כעת את V4.1 Flash Max Effort ב-81.1 בציון הכללי.
ראו אותו במעקב המודליםשורות הטבלה מגיעות רק מנתוני LiveBench שפורסמו. אנחנו לא ממציאים ציונים.
Best overall
Claude Fable 5.1 Max Effort leads this snapshot at 83.4 overall, $1.212 per successful task.
Best value per task
ox-alpha-max runs at $0.000 per successful task and still scores 69.2 overall.
Best open weights
DeepSeek V4.1 Flash Max Effort is the strongest open-weight model here at 81.1 overall — the option you can host yourself.
Best per capability
If your work is mostly one kind of task, these lead their category in this snapshot.
Every number above comes from the 2026-06-25 release dated 2026-06-25, published by a third-party benchmark and reproduced unaltered.
התרשים הראשון עונה על „מי החזק ביותר”. השני עונה על השאלה שבאמת עולה לכם כסף: על מי מהם שווה לשלם.
ארוך יותר עדיף. העמודות מציגות את ציון כללי מתוך 100; המספר לצד כל עמודה הוא הערך המדויק. בחרו שורה כדי להעביר את המודל לתרשים העלות למטה.
מוצגים 12 המובילים מתוך 58. עברו לתצוגת ההשוואה המלאה לכל המודלים.
למעלה זה חזק יותר, שמאלה זה זול יותר — כך שהקניות הטובות ביותר יושבות למעלה משמאל. הנקודות הממוספרות הן חזית הערך: שום דבר זול יותר לא מקבל ציון גבוה יותר. נקודות אפורות מנוצחות גם בציון וגם במחיר.
נבחר
Claude Fable 5.1 Max Effort
Anthropic
#7 · על חזית הערך.
הקניות הטובות ביותר (מהזול ← לחזק)
רחפו או הקישו על נקודה ממוספרת (או על השורה שלה מימין) כדי לקרוא את הציון והעלות המדויקים. מקשי החצים עוברים בין המודלים מהזול ליקר.
| מודל | ארגון | כללי | לכל משימה מוצלחת |
|---|---|---|---|
| Claude Fable 5.1 Max Effort#7 · הערך הטוב ביותר במחיר שלו | Anthropic | 83.4 | 1.212 $ |
| Claude 5.5 Opus Thinking Max Effort#6 · הערך הטוב ביותר במחיר שלו | Anthropic | 83.2 | 0.799 $ |
| Claude Fable 5 Max Effort | Anthropic | 83.0 | 1.439 $ |
| GPT-6 Astra Max Effort#5 · הערך הטוב ביותר במחיר שלו | OpenAI | 82.2 | 0.736 $ |
| GPT-6.1 Sol Max Effort#4 · הערך הטוב ביותר במחיר שלו | OpenAI | 81.6 | 0.142 $ |
| Muse Spark 1.3 xHigh Effort | Meta | 81.6 | 0.219 $ |
| DeepSeek V4.1 Flash Max Effort#3 · הערך הטוב ביותר במחיר שלו | DeepSeek | 81.1 | 0.029 $ |
| GPT-5.6 Sol Max Effort | OpenAI | 81.0 | 0.515 $ |
| GPT-5.5 Thinking xHigh Effort | OpenAI | 80.2 | 0.435 $ |
| Claude 5 Opus Thinking Max Effort | Anthropic | 80.1 | 0.699 $ |
| GPT-6 Sol Max Effort | OpenAI | 79.3 | 0.268 $ |
| Kimi K3 | Moonshot AI | 79.2 | 0.348 $ |
| Gemini 3.7 Flash High | 78.8 | 0.157 $ | |
| Qwen 3.8 Max | Alibaba | 78.5 | 0.275 $ |
| Grok 4.6 xHigh | xAI | 78.0 | 0.207 $ |
| Muse Spark 1.2 xHigh Effort | Meta | 78.0 | 0.375 $ |
| GPT-5.4 Thinking xHigh Effort | OpenAI | 78.0 | 0.387 $ |
| GPT-5.6 Terra Max Effort | OpenAI | 77.9 | 0.352 $ |
| Claude Sonnet 5.5 xHigh Effort | Anthropic | 77.8 | 0.141 $ |
| DeepSeek V4 Pro 0813 | DeepSeek | 77.4 | 0.044 $ |
| Grok 4.7 xHigh | xAI | 77.4 | 0.718 $ |
| Gemini 3.1 Pro Preview High | 77.0 | 0.286 $ | |
| DeepSeek V4 Flash Vision Exp | DeepSeek | 76.8 | 0.051 $ |
| Claude 4.7 Opus Thinking xHigh Effort | Anthropic | 76.5 | 0.528 $ |
| Qwen 3.8 Flash Next | Alibaba | 76.2 | 0.042 $ |
| Claude 4.8 Opus Thinking Max Effort | Anthropic | 76.2 | 0.983 $ |
| GLM-5.3 | Z.AI | 76.1 | 0.450 $ |
| Claude Sonnet 5 xHigh Effort | Anthropic | 76.0 | 0.505 $ |
| Grok 4.5 | xAI | 75.8 | 0.131 $ |
| Gemini 3.8 Flash High | 75.8 | 0.307 $ | |
| Qwen3.8 27B | Alibaba | 75.3 | 0.094 $ |
| Muse Spark 1.1 xHigh Effort | Meta | 75.3 | 0.198 $ |
| GPT-5.2 High | OpenAI | 74.6 | 0.234 $ |
| Gemini 3.5 Flash High | 74.6 | 0.249 $ | |
| Claude 4.6 Opus Thinking High Effort | Anthropic | 74.5 | 0.404 $ |
| DeepSeek V4 Flash 0731 | DeepSeek | 74.2 | 0.060 $ |
| GPT-5.2 Codex | OpenAI | 74.0 | 0.187 $ |
| GPT-5.6 Luna Max Effort | OpenAI | 73.6 | 0.169 $ |
| Gemini 3.6 Flash High | 73.6 | 0.235 $ | |
| GLM-5.2 | Z.AI | 73.2 | 0.225 $ |
| Qwen 3.7 Max | Alibaba | 73.1 | 0.182 $ |
| Claude 4.6 Sonnet Thinking Medium Effort | Anthropic | 73.0 | 0.306 $ |
| Claude 4.5 Opus Thinking High Effort | Anthropic | 72.6 | 0.610 $ |
| GPT-6 Luna Max Effort#2 · הערך הטוב ביותר במחיר שלו | OpenAI | 72.0 | 0.026 $ |
| Inkling xHigh Effort | Thinking Machines | 71.9 | 0.310 $ |
| GLM-5.3 Flash | Z.AI | 71.6 | 0.031 $ |
| Kimi K2.6 Thinking | Moonshot AI | 70.5 | 0.169 $ |
| GPT-5.4 Nano xHigh | OpenAI | 69.6 | 0.091 $ |
| Qwen 3.6 Plus | Alibaba | 68.9 | 0.227 $ |
| Kimi K2.7 Code | Moonshot AI | 68.4 | 0.100 $ |
| Grok Build 0.1#1 · הערך הטוב ביותר במחיר שלו | xAI | 67.8 | 0.024 $ |
| Nemotron 3 Ultra 550B A55B | NVIDIA | 67.4 | 0.371 $ |
| Minimax M3 | Minimax | 67.3 | 0.060 $ |
| GPT-5.4 Mini xHigh | OpenAI | 66.4 | 0.334 $ |
| Qwen 3.6 27B | Alibaba | 64.0 | 0.202 $ |
| Gemini 3.5 Flash-Lite High | 63.9 | 0.069 $ | |
| Grok 4.3 | xAI | 62.3 | 0.061 $ |
בחרו עד שלושה מודלים מהטבלה כדי להשוות את ציוני שבע הקטגוריות שלהם.
כל מסלול נע בין 0 ל-100. ימינה יותר זה חזק יותר; המספר המודגש הוא המוביל בשורה.
| קטגוריה | Claude Fable 5.1 Max Effort | ox-alpha-max | DeepSeek V4.1 Flash Max Effort |
|---|---|---|---|
| הסקה | 91.7 | 76.6 | 86.7 |
| קוד | 86.4 | 75.8 | 80.0 |
| קוד סוכני | 66.1 | 52.6 | 77.3 |
| מתמטיקה | 97.0 | 77.5 | 93.3 |
| ניתוח נתונים | 80.3 | 75.8 | 79.3 |
| שפה | 89.5 | 66.1 | 81.2 |
| מילוי הוראות | 73.0 | 60.3 | 70.0 |
מיינו כל קטגוריה, צמצמו את הרשימה ופתחו מודל לפירוט משימות המשנה שפורסם.
Claude Fable 5.1 Max Effort
Anthropic
83.4
כללי
1.212 $
לכל משימה מוצלחת
Claude 5.5 Opus Thinking Max Effort
Anthropic
83.2
כללי
0.799 $
לכל משימה מוצלחת
Claude Fable 5 Max Effort
Anthropic
83.0
כללי
1.439 $
לכל משימה מוצלחת
GPT-6 Astra Max Effort
OpenAI
82.2
כללי
0.736 $
לכל משימה מוצלחת
GPT-6.1 Sol Max Effort
OpenAI
81.6
כללי
0.142 $
לכל משימה מוצלחת
Muse Spark 1.3 xHigh Effort
Meta
81.6
כללי
0.219 $
לכל משימה מוצלחת
DeepSeek V4.1 Flash Max Effort
פתוחDeepSeek
81.1
כללי
0.029 $
לכל משימה מוצלחת
GPT-5.6 Sol Max Effort
OpenAI
81.0
כללי
0.515 $
לכל משימה מוצלחת
GPT-5.5 Thinking xHigh Effort
OpenAI
80.2
כללי
0.435 $
לכל משימה מוצלחת
Claude 5 Opus Thinking Max Effort
Anthropic
80.1
כללי
0.699 $
לכל משימה מוצלחת
GPT-6 Sol Max Effort
OpenAI
79.3
כללי
0.268 $
לכל משימה מוצלחת
Kimi K3
פתוחMoonshot AI
79.2
כללי
0.348 $
לכל משימה מוצלחת
Gemini 3.7 Flash High
78.8
כללי
0.157 $
לכל משימה מוצלחת
Qwen 3.8 Max
פתוחAlibaba
78.5
כללי
0.275 $
לכל משימה מוצלחת
Muse Spark 1.2 xHigh Effort
Meta
78.0
כללי
0.375 $
לכל משימה מוצלחת
Grok 4.6 xHigh
xAI
78.0
כללי
0.207 $
לכל משימה מוצלחת
GPT-5.4 Thinking xHigh Effort
OpenAI
78.0
כללי
0.387 $
לכל משימה מוצלחת
GPT-5.6 Terra Max Effort
OpenAI
77.9
כללי
0.352 $
לכל משימה מוצלחת
Claude Sonnet 5.5 xHigh Effort
Anthropic
77.8
כללי
0.141 $
לכל משימה מוצלחת
DeepSeek V4 Pro 0813
פתוחDeepSeek
77.4
כללי
0.044 $
לכל משימה מוצלחת
Grok 4.7 xHigh
xAI
77.4
כללי
0.718 $
לכל משימה מוצלחת
Gemini 3.1 Pro Preview High
77.0
כללי
0.286 $
לכל משימה מוצלחת
DeepSeek V4 Flash Vision Exp
פתוחDeepSeek
76.8
כללי
0.051 $
לכל משימה מוצלחת
Claude 4.7 Opus Thinking xHigh Effort
Anthropic
76.5
כללי
0.528 $
לכל משימה מוצלחת
Claude 4.8 Opus Thinking Max Effort
Anthropic
76.2
כללי
0.983 $
לכל משימה מוצלחת
Qwen 3.8 Flash Next
פתוחAlibaba
76.2
כללי
0.042 $
לכל משימה מוצלחת
GLM-5.3
פתוחZ.AI
76.1
כללי
0.450 $
לכל משימה מוצלחת
Claude Sonnet 5 xHigh Effort
Anthropic
76.0
כללי
0.505 $
לכל משימה מוצלחת
Grok 4.5
xAI
75.8
כללי
0.131 $
לכל משימה מוצלחת
Gemini 3.8 Flash High
75.8
כללי
0.307 $
לכל משימה מוצלחת
Qwen3.8 27B
פתוחAlibaba
75.3
כללי
0.094 $
לכל משימה מוצלחת
Muse Spark 1.1 xHigh Effort
Meta
75.3
כללי
0.198 $
לכל משימה מוצלחת
GPT-5.2 High
OpenAI
74.6
כללי
0.234 $
לכל משימה מוצלחת
Gemini 3.5 Flash High
74.6
כללי
0.249 $
לכל משימה מוצלחת
Claude 4.6 Opus Thinking High Effort
Anthropic
74.5
כללי
0.404 $
לכל משימה מוצלחת
DeepSeek V4 Flash 0731
פתוחDeepSeek
74.2
כללי
0.060 $
לכל משימה מוצלחת
GPT-5.2 Codex
OpenAI
74.0
כללי
0.187 $
לכל משימה מוצלחת
GPT-5.6 Luna Max Effort
OpenAI
73.6
כללי
0.169 $
לכל משימה מוצלחת
Gemini 3.6 Flash High
73.6
כללי
0.235 $
לכל משימה מוצלחת
GLM-5.2
פתוחZ.AI
73.2
כללי
0.225 $
לכל משימה מוצלחת
Qwen 3.7 Max
Alibaba
73.1
כללי
0.182 $
לכל משימה מוצלחת
Claude 4.6 Sonnet Thinking Medium Effort
Anthropic
73.0
כללי
0.306 $
לכל משימה מוצלחת
Claude 4.5 Opus Thinking High Effort
Anthropic
72.6
כללי
0.610 $
לכל משימה מוצלחת
GPT-6 Luna Max Effort
OpenAI
72.0
כללי
0.026 $
לכל משימה מוצלחת
Inkling xHigh Effort
פתוחThinking Machines
71.9
כללי
0.310 $
לכל משימה מוצלחת
GLM-5.3 Flash
פתוחZ.AI
71.6
כללי
0.031 $
לכל משימה מוצלחת
Kimi K2.6 Thinking
פתוחMoonshot AI
70.5
כללי
0.169 $
לכל משימה מוצלחת
GPT-5.4 Nano xHigh
OpenAI
69.6
כללי
0.091 $
לכל משימה מוצלחת
ox-alpha-max
Stealth
69.2
כללי
0.000 $
לכל משימה מוצלחת
Qwen 3.6 Plus
Alibaba
68.9
כללי
0.227 $
לכל משימה מוצלחת
Kimi K2.7 Code
פתוחMoonshot AI
68.4
כללי
0.100 $
לכל משימה מוצלחת
Grok Build 0.1
xAI
67.8
כללי
0.024 $
לכל משימה מוצלחת
Nemotron 3 Ultra 550B A55B
פתוחNVIDIA
67.4
כללי
0.371 $
לכל משימה מוצלחת
Minimax M3
Minimax
67.3
כללי
0.060 $
לכל משימה מוצלחת
GPT-5.4 Mini xHigh
OpenAI
66.4
כללי
0.334 $
לכל משימה מוצלחת
Qwen 3.6 27B
פתוחAlibaba
64.0
כללי
0.202 $
לכל משימה מוצלחת
Gemini 3.5 Flash-Lite High
63.9
כללי
0.069 $
לכל משימה מוצלחת
Grok 4.3
xAI
62.3
כללי
0.061 $
לכל משימה מוצלחת
העלות היא מדד העלות לכל משימה מוצלחת שסופק על ידי המקור עבור ההיקף שנבחר.
These scores say which model is strongest at a set of held-out tasks. They don’t say which one fits your workflow, your budget, or the tools you already pay for — and the cheapest model that clears your bar usually beats the highest scorer.
What changed recently
Dated releases from every major lab, with the vendor's own claims labelled as claims.
OpenWhat it costs to run
Our tool catalogue carries the price we last verified and the date we checked it.
OpenWhat to actually build
A deployment plan picks the stack for one workflow at your budget — models included.
Open