Score leider
GPT-5.6 Sol · Max effort
82.4 · Algemeen
Een bronvermelding van LiveBench-scores die u helpt om mogelijkheden, categorieën en kosten te vergelijken zonder details te verliezen.
Score leider
GPT-5.6 Sol · Max effort
82.4 · Algemeen
Laagste runkosten
DeepSeek V4 Pro
$0.050 · per succesvolle taak
Top open gewichten
Kimi K3
78.5 · Algemeen
Sorteer elke categorie, verklein de lijst en open een model voor de gepubliceerde subtaak uitsplitsing.
| Model | Vergelijk | |||||||||
|---|---|---|---|---|---|---|---|---|---|---|
| OpenAI | 82.4 | 91.7 | 83.9 | 65.6 | 96.2 | 79.8 | 87.7 | 71.8 | $0.589 | |
| Anthropic | 80.8 | 89.7 | 86.0 | 46.9 | 96.0 | 80.5 | 90.7 | 75.8 | $1.573 | |
| Anthropic | 80.3 | 90.2 | 83.2 | 61.3 | 94.8 | 77.9 | 87.3 | 67.5 | $0.487 | |
| OpenAI | 79.8 | 90.6 | 78.2 | 68.0 | 94.9 | 79.3 | 82.9 | 64.6 | $0.497 | |
| Moonshot AI | 78.5 | 90.7 | 81.4 | 57.6 | 84.4 | 78.7 | 85.5 | 71.4 | $0.379 | |
| 77.1 | 84.0 | 76.5 | 45.4 | 91.0 | 78.5 | 85.4 | 79.1 | $0.262 | ||
| xAI | 76.3 | 87.2 | 68.6 | 59.8 | 90.8 | 73.0 | 82.8 | 71.5 | $0.128 | |
| DeepSeek | 71.6 | 82.7 | 70.0 | 42.6 | 90.7 | 74.5 | 78.1 | 62.4 | $0.050 |
Kosten zijn de door de bron verstrekte kosten per succesvolle taak voor de geselecteerde LiveBench scope.
Scores zijn duidelijker naast kosten en het categorieprofiel van een model. Gebruik vergelijking om de afweging zichtbaar te houden.
Kosten weergave
Hoger is sterker. Lagere kosten staan verder naar links. Punten gebruiken de door de bron verstrekte kostenmetriek.
Vergelijk
Kies tot drie modellen uit het leaderboard om hun zeven categoriescores te vergelijken.
Gebruik de vergelijkknoppen in de tabel om tot drie modellen toe te voegen.