Punkteführer
GPT-5.6 Sol · Max effort
82.4 · Gesamt
Eine quellenattributierte Ansicht der LiveBench-Ergebnisse, die Ihnen hilft, Fähigkeiten, Kategoriestärken und Ausführungskosten zu vergleichen, ohne das Detail zu verlieren.
Punkteführer
GPT-5.6 Sol · Max effort
82.4 · Gesamt
Niedrigste Ausführungskosten
DeepSeek V4 Pro
$0.050 · pro erfolgreicher Aufgabe
Top-Open-Weights
Kimi K3
78.5 · Gesamt
Sortieren Sie jede Kategorie, grenzen Sie die Liste ein und öffnen Sie ein Modell für seine veröffentlichte Teilaufgabenaufschlüsselung.
| Modell | Vergleichen | |||||||||
|---|---|---|---|---|---|---|---|---|---|---|
| OpenAI | 82.4 | 91.7 | 83.9 | 65.6 | 96.2 | 79.8 | 87.7 | 71.8 | $0.589 | |
| Anthropic | 80.8 | 89.7 | 86.0 | 46.9 | 96.0 | 80.5 | 90.7 | 75.8 | $1.573 | |
| Anthropic | 80.3 | 90.2 | 83.2 | 61.3 | 94.8 | 77.9 | 87.3 | 67.5 | $0.487 | |
| OpenAI | 79.8 | 90.6 | 78.2 | 68.0 | 94.9 | 79.3 | 82.9 | 64.6 | $0.497 | |
| Moonshot AI | 78.5 | 90.7 | 81.4 | 57.6 | 84.4 | 78.7 | 85.5 | 71.4 | $0.379 | |
| 77.1 | 84.0 | 76.5 | 45.4 | 91.0 | 78.5 | 85.4 | 79.1 | $0.262 | ||
| xAI | 76.3 | 87.2 | 68.6 | 59.8 | 90.8 | 73.0 | 82.8 | 71.5 | $0.128 | |
| DeepSeek | 71.6 | 82.7 | 70.0 | 42.6 | 90.7 | 74.5 | 78.1 | 62.4 | $0.050 |
Die Kosten sind die von der Quelle bereitgestellte Metrik Kosten pro erfolgreicher Aufgabe für den ausgewählten LiveBench-Bereich.
Ergebnisse sind klarer neben Kosten und dem Kategorieprofil eines Modells. Nutzen Sie den Vergleich, um den Kompromiss sichtbar zu halten.
Kostenansicht
Höher ist stärker. Niedrigere Kosten liegen weiter links. Punkte verwenden die von der Quelle bereitgestellte Kostenmetrik.
Vergleichen
Wählen Sie bis zu drei Modelle aus der Rangliste aus, um ihre sieben Kategorieergebnisse zu vergleichen.
Verwenden Sie die Vergleichsbuttons in der Tabelle, um bis zu drei Modelle hinzuzufügen.