Stand September 2026 · Live-Status

Das KI-Modell-Radar 2026

GPT-6 Astra, Claude Fable 5.1, DeepSeek V4.1 Flash, Gemini 3.8 Flash und weitere — welche Modelle live sind, welche (wie Gemini 4 Pro) noch Gerüchte sind, welche gesperrt sind und wie Sie als Erster darauf zugreifen, sobald sie freigeschaltet werden.

Preise ändern sich: Bei QCode zahlen Sie für Claude, GPT und chinesische Modelle pro Token — aktuelle Preise unter /models.

Aktualisiert 2026-10-08

#Veröffentlichungs-Tracker #Verfügbarkeit #Benchmarks #Zugang
Statuslegende
Jetzt verfügbar Eingeschränkte Vorschau Ausgesetzt Demnächst verfügbar In Prüfung

Statusübersicht der Frontier-Modelle

Wo jedes wichtige Modell 2026 heute steht — klicken Sie auf eine Karte für den vollständigen Leitfaden.

Anthropic · Claude

OpenAI · GPT / Codex

GPT-5.5Jetzt verfügbar

Das vorherige Flaggschiff GPT-5.5, weiterhin auf QCode für Codex und die API verfügbar.

GPT-5.6 Sol/Terra/LunaJetzt verfügbar

Sol / Terra / Luna GA seit 2026-07-09. Die offizielle Preisseite zeigt derzeit Terra $2/$12 und Sol $4/$20 (die Seite merkt an, dass Sol's Aktionspreis mindestens bis 2026-11-21 gilt), dazu $0.20/$1.20 für Luna. Über QCode aufrufbar sind gpt-5.6-sol und gpt-5.6-terra; gpt-5.6-luna unterstützt QCode derzeit nicht (aus /models entfernt) – bitte nutzen Sie ein anderes GPT-Modell, etwa gpt-6.1-sol, gpt-6-sol oder gpt-5.6-terra.

GPT-5.6 vs Opus 4.8Vergleich

Direktvergleich: GPT-5.6 Sol vs Claude Opus 4.8 auf Terminal-Bench und Preise.

GPT-5.7Gerücht

Niemals veröffentlicht. Während der Gerüchtephase war der Name zwischen GPT-6 und 5.7 unentschieden; der Launch am 2026-09-03 entschied sich für GPT-6 Astra, dieser Kandidatename ist damit hinfällig. Übersicht unter /gpt-5-7-guide.

GPT-6 AstraJetzt verfügbar

Veröffentlicht am 2026-09-03. API-Modell-ID gpt-6-astra, 1,050,000 Kontext, 128,000 Output, Listenpreis $10/$50. Keine Mini- oder Nano-Variante; Codex verwendet dieselbe ID. Auf QCode aufrufbar. Unabhängig davon wurde laut CNBC (erstmals von WSJ berichtet, 2026-09-28) das nicht veröffentlichte GPT-6.1 Astra gestrichen. Das Modell, das OpenAI am 2026-09-29 veröffentlichte, ist ein anderes, gpt-6.1-sol: Input $2.00, Cache-Input $0.10, Cache-Schreibvorgänge $2.50, Output $10.00, wobei der Cache-Input mit 5% bepreist ist; auf QCode seit 2026-09-30 aufrufbar. Details unter /gpt-6-guide.

Google · Gemini

Gemini 3.5 ProVerzögert

Beim Triple-Launch am 21. Juli nicht dabei. Google gab an, dass das Modell die internen Erwartungen an Coding und komplexes Reasoning nicht erfüllte, daher verzögert sich die breite Veröffentlichung; es bleibt im Partner-Testing.

Gemini 3.5 FlashJetzt verfügbar

GA am Google I/O am 19. Mai 2026 — schnell und multimodal. QCode bietet die Gemini-Serie derzeit nicht an; bitte nutzen Sie Claude, GPT oder chinesische Modelle.

Gemini 3 ProJetzt verfügbar

Flaggschiff mit 1-M-Kontext vom November 2025 (LMArena 1501). QCode bietet die Gemini-Serie derzeit nicht an; bitte nutzen Sie Claude, GPT oder chinesische Modelle.

Gemini 3.6 FlashJetzt verfügbar

Veröffentlicht am 2026-07-21 als gemini-3.6-flash: $1.50/$7.50 Paid, 1,048,576 / 65,536 Kontext; stärkeres Coding-/Multimodal-Arbeitstier als das frühere Flash.

Gemini 3.5 Flash-LiteJetzt verfügbar

Im selben Stapel als das kosteneffizienteste Modell seiner Klasse veröffentlicht.

Gemini 3.5 Flash CyberJetzt verfügbar

Ebenfalls aus dem Stapel vom 21. Juli: ein auf Sicherheit spezialisiertes Modell, optimiert für das Finden und Beheben von Schwachstellen.

Gemini 4Gerücht

Google bestätigte am 2026-07-21, dass das Pre-Training von Gemini 4 begonnen hatte, veröffentlichte aber weder Datum, Spezifikationen noch eine SKU des Pro-Tarifs.

xAI · Grok

Grok 4.5In Prüfung

Führt AutomationBench-AA mit 51.4% an (Fable 5 48.6%, Opus 4.8 48.5%) und belegt Platz 4 im Artificial Analysis Intelligence Index bei etwa $0.34 pro Aufgabe. Der Kompromiss: Halluzinationen steigen von 25% auf 54% (AA-Omniscience). QCode führt die Grok-Familie derzeit nicht im Angebot.

Grok BuildIn Prüfung

Die auf Entwicklung ausgerichtete Agent-Umgebung von xAI; siehe die spezielle Seite für ihr Open-Source-Ökosystem und die Toolchain. QCode führt die Grok-Familie derzeit nicht im Angebot.

Grok 4.6In Prüfung

Veröffentlicht am 2026-08-12. Artificial Analysis Intelligence Index 61, gleichauf mit GPT-5.6 Sol; $2/$6 bei 500K Kontext und $0.5 Cache-Treffer. QCode führt die Grok-Familie derzeit nicht im Angebot.

Grok BotEingeschränkte Vorschau

Seit dem 2026-08-11 in früher Beta: ein „Computer-Teamkollege“ auf einem gemeinsamen Cloud-Desktop, gebündelt mit Cursor Ultra ($200/mo) oder Teams Premium ($120/seat/mo). Ein Drittanbieter-Produkt, kein Modell-Endpunkt.

Grok 4.7Gerücht

xAI veröffentlichte Grok 4.7 am 2026-09-21, „mit Preisen ab $2 pro Million Input-Tokens und $6 pro Million Output-Tokens“; die Ankündigung enthält selbst gemeldete Benchmarks, die diese Seite nicht wiedergibt. QCode bietet Grok nicht an. Zeitleiste: /grok-4-7-status-tracker.

Claude Opus 5.2Gerücht

Stand 2026-09-29 ist das neueste Opus Claude Opus 5.5 (veröffentlicht am 2026-09-22, $4 / $20), ID claude-opus-5-5, heute auf QCode verfügbar; claude-opus-5 (offizieller Preis $5 / $25) funktioniert weiterhin auf QCode, ist aber nicht mehr die neueste Stufe. Kein Modell namens „Opus 5.2“ wurde angekündigt, und Anthropic hat seine Nummerierung nicht erläutert. Tracker unter /claude-opus-5-2-status-tracker; Spezifikationen und Preise unter /claude-opus-5-5-guide.

Claude Fable 5.2Gerücht

Anthropics Vergleichstabelle führt derzeit eine Fable-Zeile, claude-fable-5-1 (2026-09-01), während claude-fable-5 in der Legacy-Liste derselben Seite steht; 5.2 hat keine Zeile, keine ID, kein Datum, keinen Preis. Tracker unter /claude-fable-5-2-status-tracker.

GPT-6 SolJetzt verfügbar

Von OpenAI am 2026-09-22 offiziell veröffentlicht, in derselben Ankündigung wie GPT-6 Luna. Offizielle ID gpt-6-sol, $2/$10, Cache-Input $0.20, 1,050,000 Kontext, maximal 128,000 Output; berechnet aus der offiziellen Preistabelle, die Hälfte von gpt-5.6-sol ($4/$20). Auf QCode aufrufbar. Tracker unter /gpt-6-sol-status-tracker.

Gemini 3.8 Flash / LiveJetzt verfügbar

Googles API-Verzeichnis listet Stand 2026-09-17 Gemini 3.8 Flash und 3.8 Live (ID gemini-3.8-live) zusammen; Google hat keine separaten GA-Daten veröffentlicht, daher erfindet diese Karte sie nicht. QCode bietet die Gemini-Serie derzeit nicht an; bitte nutzen Sie Claude, GPT oder chinesische Modelle. Leitfaden unter /gemini-3-8-flash-guide.

Claude Fable 5.1Jetzt verfügbar

Anthropics Modell-Tabelle listet releasedOn 2026-09-01 mit Lifecycle active — die Live-Version des ersten Fable. Auf QCode als claude-fable-5-1; Leitfaden unter /claude-fable-5-1-guide.

Chinesische Open-Weight-Modelle

GLM-5.2Jetzt verfügbar

Eines der stärksten Open-Weight-Coding-Modelle (MIT, veröffentlicht im Juni 2026, 744B mit 40B aktiv, 1M Kontext). Auf QCode live als glm-5.2 und glm-5.1.

DeepSeek V4Jetzt verfügbar

Die beiden heute aktiven Stufen der V4-Familie sind deepseek-v4.1-flash (2026-09-10) und deepseek-v4-pro (GA 2026-08-13), beide MIT-Weights mit 1M Kontext. Beide IDs liegen in unserem /models mit echtem 30-Tage-Traffic.

DeepSeek V4 Flash 0731Jetzt verfügbar

Das Post-Training-Update vom 2026-07-31: MIT-Gewichte, 1M / 384K, damals $0.14/$0.28, Terminal-Bench 2.1 82.7. Am 2026-09-10 veröffentlichte DeepSeek V4.1-Flash und stellte deepseek-v4-flash ein, dessen Anfragen nun von deepseek-v4.1-flash bedient werden. Verlaufsseite /deepseek-v4-flash-0731.

DeepSeek V4 Pro 0813Jetzt verfügbar

GA am 2026-08-13, 1.7T Parameter, MIT-Gewichte, zum Start $0.435/$0.87, Terminal-Bench 2.1 87.9, Artificial Analysis Intelligence Index 53. Der Changelog-Eintrag vom 2026-09-10 bestätigt, dass V4 Pro mit unveränderter Abrechnung verfügbar bleibt. Auf QCode als deepseek-v4-pro.

GLM-5.3Veröffentlicht · nicht in unserem Katalog

Veröffentlicht am 2026-08-14 (gleiche Basis wie 5.2, Post-Training-Skalierung, Coding +50%, führt CyberGym mit 84.5% an); die API ging am 08-19 live. QCode /models führt bereits glm-5.3 ($1.40/$4.40) mit echten Aufrufen in den letzten 30 Tagen. Details: /glm-5-3-guide. Der kostengünstige Tarif derselben Generation, GLM-5.3-Flash, wurde am 08-26 veröffentlicht (320B-A18B, 1M Kontext, offene MIT-Gewichte, Aktionspreis $0.075/$0.25 bis 09-09). Auf QCode nicht angebunden; Referenz: /glm-5-3-flash-guide.

Kimi · MiniMax · QwenJetzt verfügbar

Kimi K3 und K2.6 sowie die Qwen-3.7-Familie sind jetzt auf QCode live; MiniMax und weitere bleiben in Prüfung.

DeepSeek V4.1 ProGerücht

DeepSeek hat V4.1-Pro einmal benannt, in der Release-Notiz vom 2026-09-10, und der Changelog-Eintrag vom 2026-09-10 hat die zugehörige V4-Pro-Umleitung zurückgenommen: kein Datum, keine ID, kein Preis. Tracker unter /deepseek-v4-1-pro-status-tracker.

DeepSeek V4.1 FlashJetzt verfügbar

Veröffentlicht am 2026-09-10: die Notiz bezeichnet es als „das kleinste Modell unserer neuen Architektur-Familie“ mit nativem visuellem Verständnis. Auf QCode als deepseek-v4.1-flash, 1M / 384K, zwei Spitzen-/Nebenzeiten-Tarife. Leitfaden unter /deepseek-v4-1-flash-guide.

Stand 2026-09-29. Verfügbarkeit und Benchmarks ändern sich schnell; Vorschau-, Verzögert- und Gerüchte-Einträge sind gekennzeichnet.

✅ Was Sie auf QCode jetzt sofort nutzen können

Ein API-Key, mehrere Modellfamilien — wählen Sie die Modelle, die heute tatsächlich live sind.

Claude Fable 5.1

Anthropics Tabelle verzeichnet releasedOn 2026-09-01, Lifecycle aktiv. Auf QCode als claude-fable-5-1 verfügbar.

GPT-6 Astra

Ausgeliefert am 2026-09-03 als gpt-6-astra, Listenpreis $10/$50. Codex ruft diese ID direkt auf; hier besteht echter 30-Tage-Traffic.

DeepSeek V4.1 Flash

Steht in unserem /models: deepseek-v4.1-flash (2026-09-10, das laut DeepSeek das kleinste Modell in seiner neuen Architektur-Familie ist).

So erhalten Sie neue Modelle in dem Moment, in dem sie freigeschaltet werden

Erstellen Sie ein QCode-Konto — die Registrierung selbst kostet nichts. Solange Ihr Tarif aktiv ist, schalten wir neue Modelle für Sie frei, sobald sie verfügbar werden: keine zusätzliche Registrierung, kein API-Key-Wechsel. Dasselbe Guthaben und derselbe API-Key funktionieren über Claude, Codex und chinesische Modelle.

Häufig gestellte Fragen

Kann ich GPT-5.6, Fable 5 oder Gemini 3.5 Pro heute auf QCode nutzen?

GPT-5.6: ja — es wurde am 9. Juli GA; über QCode aufrufbar sind gpt-5.6-sol und gpt-5.6-terra, Luna unterstützt QCode derzeit nicht (gpt-5.6-luna wurde aus /models entfernt) – bitte nutzen Sie ein anderes GPT-Modell. Claude Fable 5: ja über die API (unser Pfad wurde am 15. Juli wiedereröffnet), während Anthropics eigene Abonnements es seit dem 19. Juli nach Tarif staffeln. Gemini 3.5 Pro befindet sich noch in der Enterprise-Vorschau; QCode bietet die Gemini-Serie derzeit nicht an – bitte nutzen Sie Claude, GPT oder chinesische Modelle. Claude Opus 4.8 und Codex (GPT-5.6) sind ebenfalls live.

Warum wurde Claude Fable 5 offline genommen?

Zwei verschiedene Dinge. Erstens: Upstream-Verfügbarkeit — Anthropic hat Fable 5 und Mythos 5 am 12. Juni 2026 weltweit ausgesetzt, um einer US-Exportkontrollvorgabe zu entsprechen (andere Claude-Modelle waren nicht betroffen); der Fable-5-Zugang wurde am 15. Juli wiederhergestellt und ist auf QCode wieder verfügbar, während Mythos 5 weiterhin nur für zugelassene Organisationen begrenzt ist. Zweitens: Abonnementregeln — seit dem 19. Juli staffelt Anthropic Fable 5 auf den eigenen Tarifen: standardmäßig auf Max sowie auf Team-/Enterprise-Premium-Plätzen, nutzungsabhängige Guthaben auf Pro- und Standard-Team-Plätzen. Die API und verbrauchsbasierte Enterprise-Tarife sind von Punkt zwei nicht betroffen.

Welches Modell 2026 ist das beste für Coding?

Stand beim vorherigen Durchlauf dieser Seite (2026-09-18): GPT-5.6 Sol führte beim terminalen agentischen Coding mit 88,8 % auf Terminal-Bench 2.1, und Claude Opus 4.8 war der übliche Maßstab für tiefgreifende Refactors und urteilsintensive Aufgaben. Seit dem 2026-09-29 bietet QCode zwei weitere Coding-Empfehlungen: Claude Opus 5.5 (claude-opus-5-5, veröffentlicht am 2026-09-22, $4/$20) und GPT-6 Sol (gpt-6-sol, veröffentlicht am 2026-09-22, $2/$10). Die selbstberichteten Benchmarks in den Veröffentlichungsbeiträgen werden hier nicht übernommen. GLM-5.2 bleibt unter den stärksten Open-Weight-Modellen, und QCode /models listet glm-5.2. Wir halten dieses Radar mit neuen Benchmarks aktuell.

Fügt QCode neue Modelle automatisch hinzu?

Ja. Wenn ein Modell breit verfügbar wird und wir Kapazität gesichert haben, aktivieren wir es für alle Konten — Ihr vorhandener API-Key und Ihr Guthaben funktionieren sofort. Beispiel: Claude Haiku 5.5 wurde am 2026-10-07 unter der Modell-ID claude-haiku-5-5 veröffentlicht und ist bei QCode bereits verfügbar; Sie rufen es mit dem vorhandenen Key auf, indem Sie model auf claude-haiku-5-5 setzen; die Preise stehen auf /models. Ein weiteres Haiku im Angebot ist claude-haiku-4-5-20251001 ($1/$5), mit Außerdienststellung „frühestens am 2026-10-15“ — der frühestmögliche Tag, kein Abschalttermin.

Seien Sie bei jedem 2026-Launch als Erster dabei

Aktivieren Sie einen Tarif ab $8.57/Monat und nutzen Sie Claude, Codex und chinesische Modelle noch heute — neue Modelle werden für denselben API-Key in dem Moment freigeschaltet, in dem sie verfügbar werden.

Erst testen, dann entscheiden

Unsicher bei der Tarifwahl? Beginnen Sie mit Starter ($8.57/Monat) und wechseln Sie auf einen höheren Tarif, wenn Sie zufrieden sind — der ungenutzte Wert des alten Tarifs geht auf Ihr Guthaben zurück.