Deutsch · 9 Min. Lesezeit
KI-Modell-Releases im Blick: was 2026 erschienen ist und was noch unbestätigt ist
Claude Fable 5.1, GPT-6 Astra, Grok 4.7, Claude Opus 5.5, GPT-6 Sol und Luna, Claude Sonnet 5.5, GPT-6.1 Sol und Claude Haiku 5.5 sind erschienen, mit Datum, Preisen und Quellen. Gemini 4 Argon ist angekündigt, aber nicht im Verkauf; GLM-5.5 ist weiterhin nicht angekündigt. Aktualisiert am 1. Oktober 2026.
Von Dapols ·
Die kurze Antwort: Von den fünf am meisten diskutierten kommenden Modellen aus unserer August-Ausgabe sind drei inzwischen erschienen: Claude Fable 5.1 (1. September 2026), GPT-6 Astra (angekündigt am 3. September, allgemein verfügbar ab 4. September) und Grok 4.7 (21. September). Zwei sind weiterhin nicht allgemein erschienen: Google hat am 30. September Gemini 4 Argon angekündigt, verkauft es aber noch nicht, und Z.ai hat GLM-5.5 nie angekündigt. Am 22. September kamen drei weitere hinzu: Claude Opus 5.5 von Anthropic sowie GPT-6 Sol und GPT-6 Luna von OpenAI, eine Woche vor dem DevDay.
Update, 1. Oktober 2026: Seit unserer letzten Ausgabe sind Claude Sonnet 5.5 am 28. September und GPT-6.1 Sol am 29. September erschienen, auf OpenAIs DevDay, wo OpenAI auch dots angekündigt hat, ständig laufende Agenten für ChatGPT Pro und Business Premium. Google hat Gemini 4 Argon am 30. September in einer begrenzten Freigabe für geprüfte Cyber-Verteidiger angekündigt; kaufen kann man es noch nicht. Claude Haiku 5.5 ist angekündigt, nicht erschienen.
Korrektur, 23. September 2026: Die Fassung vom 22. September nannte GPT-6 Sol ein Gerücht. OpenAI hat es am selben Tag zusammen mit GPT-6 Luna veröffentlicht. Der GPT-6-Abschnitt unten ist mit Quellen neu geschrieben.
Aktualisiert am 1. Oktober 2026 (erstmals zusammengestellt am 14. August 2026). Diese Seite verfolgt Ankündigungen und Releases, keine Prognosen. Wir veröffentlichen keine erwarteten Benchmark-Werte, erwarteten Preise oder erwarteten Erscheinungstermine für Modelle, die keine haben. Diese Zahlen existieren nicht, und sie zu erfinden ist der Weg, wie eine Seite unzitierbar wird. Jeder Eintrag unten ist damit gekennzeichnet, was die Quelle tatsächlich ist.
Wie wir klassifizieren
| Label | Bedeutet |
|---|---|
| Erschienen | Das Labor hat es veröffentlicht, mit Launch-Beitrag, Modell-ID oder Doku und einem Preis |
| Bestätigt | Das Labor selbst hat es veröffentlicht oder offiziell erklärt, aber noch nicht ausgeliefert |
| Von Verantwortlichem angekündigt | Ein Gründer oder eine Führungskraft hat es öffentlich gesagt, aber das Labor hat weder Model Card noch Doku oder Preise veröffentlicht |
| Berichtet | Glaubwürdige Medien oder Analysten berichten davon; das Labor hat es nicht bestätigt |
| Gerücht | Nur Community, Leaks oder Social-Media-Beiträge. Keine institutionelle Quelle |
Stand auf einen Blick (1. Oktober 2026)
| Modell | Labor | Status | Datum |
|---|---|---|---|
| Claude Fable 5.1 | Anthropic | Erschienen | 1. September 2026 |
| GPT-6 Astra | OpenAI | Erschienen | Angekündigt 3. September, allgemein verfügbar 4. September 2026 |
| Grok 4.7 | xAI | Erschienen | 21. September 2026 |
| Gemini 4 Argon | Bestätigt, nur begrenzte Freigabe, nicht im Verkauf | Angekündigt am 30. September 2026; kein Termin für die allgemeine Freigabe | |
| GLM-5.5 | Z.ai | Berichtet, nicht angekündigt | Kein Termin veröffentlicht |
| Claude Opus 5.5 | Anthropic | Erschienen | 22. September 2026 |
| GPT-6 Sol | OpenAI | Erschienen | 22. September 2026 |
| GPT-6 Luna | OpenAI | Erschienen | 22. September 2026 |
| GPT-6 Terra | OpenAI | Gerücht | Nichts veröffentlicht |
| Claude Sonnet 5.5 | Anthropic | Erschienen | 28. September 2026 |
| GPT-6.1 Sol | OpenAI | Erschienen | 29. September 2026 |
| Claude Haiku 5.5 | Anthropic | Erschienen | 7. Oktober 2026 |
Anthropic Claude Fable 5.1 — Erschienen am 1. September 2026
Im August war das noch ein Gerücht: kein Launch-Beitrag, keine Modell-ID, kein Preiseintrag. Am 1. September 2026 hat Anthropic das Modell veröffentlicht, am selben Tag verfügbar über die Claude API, AWS, Google Cloud und Azure.
- Preis: 10 $ / 50 $ pro Million Input-/Output-Tokens, unverändert gegenüber Fable 5. Cache-Reads wurden um 75 % auf 0,25 $ pro Million gesenkt.
- Von Anthropic gemeldete Benchmarks: 55,8 % auf Terminal-Bench 4.0 und 73,4 % auf CursorBench 3.2.0. Das sind Anthropics eigene Werte.
- Claude Mythos 5.1, dasselbe Grundmodell mit schwächeren Cyber-Schutzmechanismen, wurde gleichzeitig angekündigt. Es ist hinter Verifizierungsprogrammen gesperrt und auf eine Reihe von US-Organisationen beschränkt, die meisten Käufer bekommen es also nicht.
Das Gerücht aus dem Juli lag beim Preis richtig (unverändert 10 $/50 $) und beim Zeitpunkt ungefähr richtig (erwartet war August, erschienen ist es am 1. September).
Was das für ein Unternehmen bedeutet: Die Preisliste pro Token hat sich nicht bewegt, die eigentliche Änderung ist günstigerer gecachter Input. Das hilft nur, wenn Ihr Workload denselben Kontext immer wieder sendet. Details in unserem Modell-Tracker.
OpenAI GPT-6 Astra — Erschienen am 4. September 2026
OpenAI hat Astra erstmals am 1. August 2026 erwähnt, in einem Beitrag über Mathematik-Ergebnisse, und anschließend einen Teil der internen Arbeit pausiert, nachdem eine Evaluierung große Fortschritte bei agentischem Programmieren und Cybersecurity gezeigt hatte. Erschienen ist es unter dem Namen GPT-6 Astra: zuerst für Unternehmen im Trusted Access Program von OpenAI am 3. September 2026, dann ab 4. September allgemein verfügbar über die API und die bezahlten ChatGPT-Pläne.
- Preis: 10 $ / 50 $ pro Million Input-/Output-Tokens, dieselbe Preisliste wie Claude Fable 5.1. Prompts über 272K Input-Tokens werden für die gesamte Anfrage mit dem 2-fachen Input- und 1,5-fachen Output-Preis abgerechnet.
- Kontext: 922.000 Input-Tokens und 128.000 Output-Tokens laut API-Model-Card.
- Von OpenAI gemeldete Benchmarks: 72,6 % auf OSWorld 2.0 (Computerbedienung) und 57,7 % auf Terminal-Bench 4.0. Das sind OpenAIs eigene Werte.
- Die fortgeschrittenen Cybersecurity-Fähigkeiten bleiben auf eine Testergruppe beschränkt.
Was das für ein Unternehmen bedeutet: Das Modell ist dafür gebaut, einen Computer durch lange Ketten von Klicks und Formularen zu steuern. Wenn Ihre Arbeit aus Entwürfen und Antworten besteht, ist es ein teurer Weg dorthin.
xAI Grok 4.7 — Erschienen am 21. September 2026
Im August existierte Grok 4.7 nur in öffentlichen Aussagen von Elon Musk. xAI hat es am 21. September 2026 veröffentlicht, über die xAI API, OpenRouter, Cursor und Grok Build.
- Preis: 2 $ / 6 $ pro Million Input-/Output-Tokens für Prompts unter 200K Tokens, darüber 4 $ / 12 $. Das ist dieselbe Preisliste wie bei Grok 4.6.
- Kontext: 500.000 Tokens laut den Developer-Release-Notes von xAI. Der Reasoning-Aufwand lässt sich auf low, medium, high oder xhigh setzen.
- Von xAI gemeldeter Benchmark: 38,0 % auf Terminal-Bench 4.0, gegenüber 20,3 % bei Grok 4.6.
- Unabhängiger Wert: Artificial Analysis sieht es bei 46 auf seinem Intelligence Index bei xhigh-Aufwand, gegenüber 53 für Claude Fable 5.1 und GPT-6 Astra auf derselben Skala. Außerdem stuft es Grok 4.7 als sehr ausführlich ein, die Kosten pro Aufgabe liegen also höher, als die Preisliste vermuten lässt.
Korrektur zu unserer August-Ausgabe: Wir hatten Musks Beschreibung von Grok 4.7 als Modell mit „2,1 Billionen Parametern“ wiedergegeben. xAI hat für Grok 4.7 keine Parameterzahl veröffentlicht, deshalb wiederholen wir diese Zahl nicht mehr.
Was das für ein Unternehmen bedeutet: Wenn Sie bereits Grok 4.6 nutzen, ist der Wechsel auf 4.7 eine einzeilige Modelländerung zum gleichen Preis. Ein unabhängiger Index sieht es aber weiterhin deutlich hinter den beiden Flaggschiffen zu 10 $/50 $.
Google Gemini 4 Argon — Angekündigt am 30. September 2026, noch nicht im Verkauf
Google erklärte am 21. Juli 2026, man habe „bereits unseren bisher ehrgeizigsten Pre-Training-Lauf für Gemini 4 gestartet“, und Sundar Pichai beschrieb es als deutlich größeres Frontier-Modell. Am 30. September 2026 hat Google Gemini 4 Argon angekündigt, ein Frontier-Modell für langfristige Softwareentwicklung, Wissensarbeit in Unternehmen wie Recht und Finanzen sowie Cyberabwehr.
- Verfügbarkeit: nicht allgemein verfügbar. Es wird nur über Googles Fairwind-Programm an geprüfte Cyber-Verteidiger ausgerollt, während Google das freiwillige Vorab-Prüfverfahren der US-Regierung durchläuft. Laut Google kommt die breite Freigabe „so bald wie möglich“, zuerst für zahlende API-Kunden und Abonnenten von Google AI Ultra, ohne Termin.
- Angekündigter Preis: zur Einführung 2 $ / 10 $ pro Million Input-/Output-Tokens, gecachter Input 95 % günstiger, danach 4 $ / 20 $.
- Output-Limit: 1 Million Tokens statt bisher 64.000. Das Input-Kontextfenster nennt Googles Beitrag nicht.
- Von Google gemeldete Benchmarks: 77,9 % auf DeepSWE v1.1, laut Google ein neuer Bestwert, und 51,3 % auf AutomationBench, Platz 1. Das sind Googles eigene Angaben.
- Unabhängiger Wert: Artificial Analysis gibt ihm 53 Punkte auf seinem Intelligence Index bei hohem Aufwand, Platz 8 von 223, hinter Claude Opus 5.5 mit 58.
Was Google im September tatsächlich für alle ausgeliefert hat, ist Gemini 3.8 Flash (2. September), das dritte Flash-Release innerhalb von sechs Wochen.
Was das für ein Unternehmen bedeutet: Argon sieht auf dem Papier stark aus, aber man kann es nicht kaufen. Wenn Sie heute auf Gemini setzen, ist Gemini 3.8 Flash das, was Sie tatsächlich nutzen können; testen Sie neu, sobald Argon in der Gemini API oder bei Google AI Ultra ankommt.
Z.ai GLM-5.5 — Berichtet, weiterhin nicht angekündigt
Z.ai hat GLM-5.5 weiterhin nicht angekündigt. Keine Model Card, keine Benchmarks, keine Preise, kein bestätigter Name. Das Launch-Fenster im August stammte aus einer JPMorgan-Research-Notiz, über die Reuters und CGTN am 30. Juni 2026 berichteten, und dieses Fenster ist ohne Release verstrichen.
Was Z.ai stattdessen ausgeliefert hat: GLM-5.3 am 14. August, aufgebaut auf dem Basismodell von GLM-5.2, und GLM-5.3-Flash am 26. August, ein Open-Weight-Modell, das laut Z.ai bei Coding-Benchmarks deutlich vor GLM-5.2 liegt (Herstellerangabe).
Was das für ein Unternehmen bedeutet: Eine Analystennotiz ist keine Roadmap. Evaluieren Sie die GLM-5.3-Modelle, die veröffentlicht und bepreist sind.
Anthropic Claude Opus 5.5 — Erschienen am 22. September 2026
Anthropic hat Opus 5.5 am 22. September 2026 als Nachfolger von Opus 5 veröffentlicht, in der Claude API als claude-opus-5-5 sowie auf AWS, Google Cloud und Azure.
- Preis: 4 $ / 20 $ pro Million Input-/Output-Tokens, gesenkt von 5 $ / 25 $ bei Opus 5. Cache-Reads kosten 0,20 $ pro Million.
- Kontext: 1 Million Input-Tokens und 128.000 Output-Tokens laut Anthropics Modellübersicht.
- Von Anthropic gemeldete Benchmarks: 66,4 % auf Terminal-Bench 4.0 gegenüber 55,8 % bei Fable 5.1, und 57,8 % auf CursorBench 4.0.
- Unabhängiger Wert: Artificial Analysis gibt ihm 58 Punkte auf seinem Intelligence Index, Platz 1 von 212 Modellen, vor Fable 5.1 und GPT-6 Astra mit je 53.
- Anthropic führt Opus 5, Fable 5 und Opus 4.8 jetzt als Legacy-Modelle. Sie sind weiter verfügbar, nicht abgeschaltet. Sonnet 5.5 folgte am 28. September (siehe Claude Sonnet 5.5 vs Opus 5.5 vs GPT-6 Sol); Haiku 5.5 folgte am 7. Oktober.
Was das für ein Unternehmen bedeutet: ein günstigeres Claude-Modell, das ein unabhängiger Index vor beide Flaggschiffe zu 10 $ / 50 $ setzt. Wer für Opus 5 oder Fable 5.1 zahlt, sollte es zuerst testen.
OpenAI GPT-6 Sol und GPT-6 Luna — Erschienen am 22. September 2026
In unserer vorigen Ausgabe war GPT-6 Sol ein Gerücht mit Blick auf den DevDay. OpenAI hat GPT-6 Sol und GPT-6 Luna am 22. September 2026 veröffentlicht, in der API als gpt-6-sol und gpt-6-luna sowie in ChatGPT Work und Codex für Plus, Pro, Business, Enterprise und Edu. Free- und Go-Nutzer können Luna in der Desktop-App verwenden. Ein GPT-6 Terra ist nicht erschienen.
- Preis: Sol 2 $ / 10 $ pro Million Input-/Output-Tokens, Luna 0,10 $ / 0,50 $. Beide kosten die Hälfte von GPT-5.6 Sol und Luna.
- Lange Prompts kosten mehr: Ein Prompt über 272.000 Input-Tokens wird für die gesamte Anfrage mit doppeltem Input- und 1,5-fachem Output-Preis abgerechnet, also 4 $ / 15 $ bei Sol und 0,20 $ / 0,75 $ bei Luna.
- Kontext: jeweils 1.050.000 Input-Tokens und 128.000 Output-Tokens.
- Von OpenAI gemeldete Benchmarks: Sol 33,2 % auf AutomationBench, über Claude Opus 5 mit 26,9 %; Luna 66,6 % auf DeepSWE v1.1.
- GPT-6 Astra bleibt OpenAIs Flaggschiff.
Nicht zu verwechseln mit GPT-5.6 Sol und Luna, erschienen am 9. Juli 2026 und weiter im Angebot. GPT-5.6 Sol kostet mindestens bis zum 21. November 2026 einen Aktionspreis von 4 $ / 20 $.
Was das für ein Unternehmen bedeutet: Luna hat jetzt einen der niedrigsten Listenpreise der großen Labore, unter dem von DeepSeek V4.1 Flash außerhalb der Spitzenzeiten. Bei langen Prompts ist DeepSeek V4.1 Flash außerhalb der Spitzenzeiten weiterhin günstiger. Unser Dreier-Vergleich zeigt, was sich wofür eignet.
OpenAI GPT-6.1 Sol — Erschienen am 29. September 2026
Eine Woche nach GPT-6 Sol hat OpenAI auf dem DevDay am 29. September 2026 GPT-6.1 Sol veröffentlicht, in der API als gpt-6.1-sol sowie in ChatGPT Work und Codex für Plus, Pro, Business, Enterprise und Edu. Im normalen ChatGPT-Chat ist es noch nicht.
- Preis: 2 $ / 10 $ pro Million Input-/Output-Tokens, wie GPT-6 Sol. Gecachter Input kostet 0,10 $, die Hälfte von GPT-6 Sol. Die 272.000-Token-Regel gilt weiter: Ein längerer Prompt wird für die ganze Anfrage mit doppeltem Input- und 1,5-fachem Output-Preis abgerechnet.
- Kontext: 1.050.000 Input-Tokens und 128.000 Output-Tokens.
- Von OpenAI gemeldete Benchmarks: gleichauf mit GPT-6 Astra auf DeepSWE v1.1 bei etwa einem Fünftel der Kosten, und auf AutomationBench bei mittlerem Aufwand 2,2 Punkte über Claude Opus 5.5, zu etwa einem Drittel der Kosten. Das sind OpenAIs eigene Angaben.
- Unabhängiger Wert: Artificial Analysis gibt ihm 52 Punkte auf seinem Intelligence Index, gegenüber 48 bei GPT-6 Sol, bei rund 0,72 $ pro Index-Aufgabe.
- Ein schnelleres GPT-6.1 Sol Ultrafast für Codex ist „in den kommenden Tagen“ angekündigt.
Auf demselben DevDay hat OpenAI dots angekündigt, ständig laufende Agenten auf Basis von GPT-6 Astra, die für ChatGPT-Pro-Nutzer außerhalb des EWR, der Schweiz und des Vereinigten Königreichs sowie für Business-Premium-Nutzer ausgerollt werden. In Free, Go und Plus gibt es sie nicht.
Was das für ein Unternehmen bedeutet: Wenn Sie gpt-6-sol aufrufen, ist der Wechsel auf gpt-6.1-sol eine einzeilige Änderung zum gleichen Listenpreis. Unser Ratgeber bestes KI-Modell zum Programmieren vergleicht es mit Claude Opus 5.5 und Sonnet 5.5.
Das Muster, das auffällt
Die erschienenen Modelle wurden rund um agentisches Programmieren und lang laufende Aufgaben positioniert, nicht um Chat-Qualität. Zwei davon haben ihre stärksten Cybersecurity-Fähigkeiten zurückgehalten: Anthropic hinter den Verifizierungsprogrammen von Claude Mythos 5.1, OpenAI hinter einer Testergruppe für GPT-6 Astra. Ein Modell zu launchen und einen Teil davon für eine Sicherheitsprüfung zurückzuhalten, ist inzwischen normal. Gemini 4 Argon geht weiter: angekündigt, mit Preis, und zum Start nur für geprüfte Cyber-Verteidiger verfügbar.
Die praktische Folge: Der Abstand zwischen Ankündigung und voller Verfügbarkeit wächst. Astra brauchte von der ersten Erwähnung bis zur allgemeinen Verfügbarkeit rund fünf Wochen, und Teile davon sind immer noch nicht allgemein verfügbar. Planen Sie mit dem, was heute ausgeliefert und bepreist ist.
Was wir nicht veröffentlichen
Wir schreiben keine erwarteten Werte in eine Tabelle. Wir mitteln keine gerüchteweisen Preise. Wir geben einem nicht angekündigten Modell keinen Erscheinungstermin, weil ein Prognosemarkt einen nahelegt. Sobald ein Modell hier echte Zahlen veröffentlicht, bekommt es einen echten Eintrag in unserem Modell-Tracker, und ein unabhängiger Wert bringt es auf unsere Benchmark-Seite.
Wenn Sie Ihre Modellwahl an dem entschieden haben wollen, was messbar verfügbar ist, statt an Launch-Kalendern, leistet genau das ein Business-KI-Plan (99 $ einmalig, optional 29 $/Monat, um ihn aktuell zu halten). Der kostenlose 2-Minuten-KI-Planfinder ist der schnelle erste Durchgang.
Quellen: Anthropic, Claude Fable and Mythos 5.1 (1. September 2026); OpenAI, GPT-6 Astra und die API-Model-Card (September 2026); xAI, Grok 4.7 und Developer-Release-Notes (21. September 2026); Artificial Analysis, Benchmarking Grok 4.7; Google, Gemini 3.8 Flash (2. September 2026) und die Erklärung zum Pre-Training von Gemini 4 (21. Juli 2026); Z.ai, GLM-5.3 und GLM-5.3-Flash; Reuters/CGTN unter Berufung auf JPMorgan (30. Juni 2026) zu GLM-5.5; OpenAI, Previewing GPT-5.6 Sol; Anthropic, Claude Opus 5.5 und die Modellübersicht (22. September 2026); Artificial Analysis, Claude Opus 5.5; OpenAI, Introducing GPT-6 Sol and Luna und die API-Preise (22. September 2026); OpenAI, Introducing GPT-6.1 Sol, Introducing dots und der DevDay-2026-Rückblick (29. September 2026); Google, Gemini 4 Argon (30. September 2026); Artificial Analysis, GPT-6.1 Sol und Gemini 4 Argon. Geprüft am 1. Oktober 2026.