Das KI-Modell-Radar 2026
GPT-6 Astra, Claude Fable 5.1, DeepSeek V4.1 Flash, Gemini 3.8 Flash und weitere — welche Modelle live sind, welche (wie Gemini 4 Pro) noch Gerüchte sind, welche gesperrt sind und wie Sie als Erster darauf zugreifen, sobald sie freigeschaltet werden.
Preise ändern sich: Bei QCode zahlen Sie für Claude, GPT und chinesische Modelle pro Token — aktuelle Preise unter /models.
- Bezahlung pro Token — aktuelle Preise unter /models
- Zahlung per Karte (Visa / Mastercard / AMEX), Apple Pay, Google Pay oder Krypto
- Selbstbedienung: aufladen und sofort aktivieren
Aktualisiert 2026-10-08
Statusübersicht der Frontier-Modelle
Wo jedes wichtige Modell 2026 heute steht — klicken Sie auf eine Karte für den vollständigen Leitfaden.
Anthropic · Claude
Die Anthropic-Flaggschiff-Reihe bleibt verfügbar; Claude Opus 5 ($5/$25, veröffentlicht am 2026-07-24) kam danach, und seit dem 2026-09-29 ist das neueste Opus Claude Opus 5.5 (claude-opus-5-5, $4/$20, veröffentlicht am 2026-09-22).
Anthropics Sonnet der Mittelklasse ist auf QCode live. Standardpreis $2/$10, nachdem die Erhöhung auf $3/$15 vom 2026-09-01 zurückgenommen wurde. Claude Sonnet 5.5, veröffentlicht am 2026-09-28, ist gleich bepreist ($2/$10, Cache-Lesungen $0.20); claude-sonnet-5-5 ist seit 2026-09-29 auf QCode verfügbar.
Das Flaggschiff der Mythos-Klasse wurde am 9. Juni eingeführt, am 12. Juni weltweit unter einer US-Exportkontrollvorgabe ausgesetzt und am 15. Juli über den QCode-Pfad wiederhergestellt. Auf Anthropics eigenen Abonnements ist es seit dem 19. Juli nach Tarif gestaffelt; die API ist nicht betroffen.
Die in begrenzter Auflage veröffentlichte Schwester von Fable 5 — nur für zugelassene Organisationen verfügbar (Project Glasswing), nicht allgemein verfügbar.
OpenAI · GPT / Codex
Das vorherige Flaggschiff GPT-5.5, weiterhin auf QCode für Codex und die API verfügbar.
Sol / Terra / Luna GA seit 2026-07-09. Die offizielle Preisseite zeigt derzeit Terra $2/$12 und Sol $4/$20 (die Seite merkt an, dass Sol's Aktionspreis mindestens bis 2026-11-21 gilt), dazu $0.20/$1.20 für Luna. Über QCode aufrufbar sind gpt-5.6-sol und gpt-5.6-terra; gpt-5.6-luna unterstützt QCode derzeit nicht (aus /models entfernt) – bitte nutzen Sie ein anderes GPT-Modell, etwa gpt-6.1-sol, gpt-6-sol oder gpt-5.6-terra.
Direktvergleich: GPT-5.6 Sol vs Claude Opus 4.8 auf Terminal-Bench und Preise.
Niemals veröffentlicht. Während der Gerüchtephase war der Name zwischen GPT-6 und 5.7 unentschieden; der Launch am 2026-09-03 entschied sich für GPT-6 Astra, dieser Kandidatename ist damit hinfällig. Übersicht unter /gpt-5-7-guide.
Veröffentlicht am 2026-09-03. API-Modell-ID gpt-6-astra, 1,050,000 Kontext, 128,000 Output, Listenpreis $10/$50. Keine Mini- oder Nano-Variante; Codex verwendet dieselbe ID. Auf QCode aufrufbar. Unabhängig davon wurde laut CNBC (erstmals von WSJ berichtet, 2026-09-28) das nicht veröffentlichte GPT-6.1 Astra gestrichen. Das Modell, das OpenAI am 2026-09-29 veröffentlichte, ist ein anderes, gpt-6.1-sol: Input $2.00, Cache-Input $0.10, Cache-Schreibvorgänge $2.50, Output $10.00, wobei der Cache-Input mit 5% bepreist ist; auf QCode seit 2026-09-30 aufrufbar. Details unter /gpt-6-guide.
Google · Gemini
Beim Triple-Launch am 21. Juli nicht dabei. Google gab an, dass das Modell die internen Erwartungen an Coding und komplexes Reasoning nicht erfüllte, daher verzögert sich die breite Veröffentlichung; es bleibt im Partner-Testing.
GA am Google I/O am 19. Mai 2026 — schnell und multimodal. QCode bietet die Gemini-Serie derzeit nicht an; bitte nutzen Sie Claude, GPT oder chinesische Modelle.
Flaggschiff mit 1-M-Kontext vom November 2025 (LMArena 1501). QCode bietet die Gemini-Serie derzeit nicht an; bitte nutzen Sie Claude, GPT oder chinesische Modelle.
Veröffentlicht am 2026-07-21 als gemini-3.6-flash: $1.50/$7.50 Paid, 1,048,576 / 65,536 Kontext; stärkeres Coding-/Multimodal-Arbeitstier als das frühere Flash.
Im selben Stapel als das kosteneffizienteste Modell seiner Klasse veröffentlicht.
Ebenfalls aus dem Stapel vom 21. Juli: ein auf Sicherheit spezialisiertes Modell, optimiert für das Finden und Beheben von Schwachstellen.
Google bestätigte am 2026-07-21, dass das Pre-Training von Gemini 4 begonnen hatte, veröffentlichte aber weder Datum, Spezifikationen noch eine SKU des Pro-Tarifs.
xAI · Grok
Führt AutomationBench-AA mit 51.4% an (Fable 5 48.6%, Opus 4.8 48.5%) und belegt Platz 4 im Artificial Analysis Intelligence Index bei etwa $0.34 pro Aufgabe. Der Kompromiss: Halluzinationen steigen von 25% auf 54% (AA-Omniscience). QCode führt die Grok-Familie derzeit nicht im Angebot.
Die auf Entwicklung ausgerichtete Agent-Umgebung von xAI; siehe die spezielle Seite für ihr Open-Source-Ökosystem und die Toolchain. QCode führt die Grok-Familie derzeit nicht im Angebot.
Veröffentlicht am 2026-08-12. Artificial Analysis Intelligence Index 61, gleichauf mit GPT-5.6 Sol; $2/$6 bei 500K Kontext und $0.5 Cache-Treffer. QCode führt die Grok-Familie derzeit nicht im Angebot.
Seit dem 2026-08-11 in früher Beta: ein „Computer-Teamkollege“ auf einem gemeinsamen Cloud-Desktop, gebündelt mit Cursor Ultra ($200/mo) oder Teams Premium ($120/seat/mo). Ein Drittanbieter-Produkt, kein Modell-Endpunkt.
xAI veröffentlichte Grok 4.7 am 2026-09-21, „mit Preisen ab $2 pro Million Input-Tokens und $6 pro Million Output-Tokens“; die Ankündigung enthält selbst gemeldete Benchmarks, die diese Seite nicht wiedergibt. QCode bietet Grok nicht an. Zeitleiste: /grok-4-7-status-tracker.
Stand 2026-09-29 ist das neueste Opus Claude Opus 5.5 (veröffentlicht am 2026-09-22, $4 / $20), ID claude-opus-5-5, heute auf QCode verfügbar; claude-opus-5 (offizieller Preis $5 / $25) funktioniert weiterhin auf QCode, ist aber nicht mehr die neueste Stufe. Kein Modell namens „Opus 5.2“ wurde angekündigt, und Anthropic hat seine Nummerierung nicht erläutert. Tracker unter /claude-opus-5-2-status-tracker; Spezifikationen und Preise unter /claude-opus-5-5-guide.
Anthropics Vergleichstabelle führt derzeit eine Fable-Zeile, claude-fable-5-1 (2026-09-01), während claude-fable-5 in der Legacy-Liste derselben Seite steht; 5.2 hat keine Zeile, keine ID, kein Datum, keinen Preis. Tracker unter /claude-fable-5-2-status-tracker.
Von OpenAI am 2026-09-22 offiziell veröffentlicht, in derselben Ankündigung wie GPT-6 Luna. Offizielle ID gpt-6-sol, $2/$10, Cache-Input $0.20, 1,050,000 Kontext, maximal 128,000 Output; berechnet aus der offiziellen Preistabelle, die Hälfte von gpt-5.6-sol ($4/$20). Auf QCode aufrufbar. Tracker unter /gpt-6-sol-status-tracker.
Googles API-Verzeichnis listet Stand 2026-09-17 Gemini 3.8 Flash und 3.8 Live (ID gemini-3.8-live) zusammen; Google hat keine separaten GA-Daten veröffentlicht, daher erfindet diese Karte sie nicht. QCode bietet die Gemini-Serie derzeit nicht an; bitte nutzen Sie Claude, GPT oder chinesische Modelle. Leitfaden unter /gemini-3-8-flash-guide.
Anthropics Modell-Tabelle listet releasedOn 2026-09-01 mit Lifecycle active — die Live-Version des ersten Fable. Auf QCode als claude-fable-5-1; Leitfaden unter /claude-fable-5-1-guide.
Chinesische Open-Weight-Modelle
Eines der stärksten Open-Weight-Coding-Modelle (MIT, veröffentlicht im Juni 2026, 744B mit 40B aktiv, 1M Kontext). Auf QCode live als glm-5.2 und glm-5.1.
Die beiden heute aktiven Stufen der V4-Familie sind deepseek-v4.1-flash (2026-09-10) und deepseek-v4-pro (GA 2026-08-13), beide MIT-Weights mit 1M Kontext. Beide IDs liegen in unserem /models mit echtem 30-Tage-Traffic.
Das Post-Training-Update vom 2026-07-31: MIT-Gewichte, 1M / 384K, damals $0.14/$0.28, Terminal-Bench 2.1 82.7. Am 2026-09-10 veröffentlichte DeepSeek V4.1-Flash und stellte deepseek-v4-flash ein, dessen Anfragen nun von deepseek-v4.1-flash bedient werden. Verlaufsseite /deepseek-v4-flash-0731.
GA am 2026-08-13, 1.7T Parameter, MIT-Gewichte, zum Start $0.435/$0.87, Terminal-Bench 2.1 87.9, Artificial Analysis Intelligence Index 53. Der Changelog-Eintrag vom 2026-09-10 bestätigt, dass V4 Pro mit unveränderter Abrechnung verfügbar bleibt. Auf QCode als deepseek-v4-pro.
Veröffentlicht am 2026-08-14 (gleiche Basis wie 5.2, Post-Training-Skalierung, Coding +50%, führt CyberGym mit 84.5% an); die API ging am 08-19 live. QCode /models führt bereits glm-5.3 ($1.40/$4.40) mit echten Aufrufen in den letzten 30 Tagen. Details: /glm-5-3-guide. Der kostengünstige Tarif derselben Generation, GLM-5.3-Flash, wurde am 08-26 veröffentlicht (320B-A18B, 1M Kontext, offene MIT-Gewichte, Aktionspreis $0.075/$0.25 bis 09-09). Auf QCode nicht angebunden; Referenz: /glm-5-3-flash-guide.
Kimi K3 und K2.6 sowie die Qwen-3.7-Familie sind jetzt auf QCode live; MiniMax und weitere bleiben in Prüfung.
DeepSeek hat V4.1-Pro einmal benannt, in der Release-Notiz vom 2026-09-10, und der Changelog-Eintrag vom 2026-09-10 hat die zugehörige V4-Pro-Umleitung zurückgenommen: kein Datum, keine ID, kein Preis. Tracker unter /deepseek-v4-1-pro-status-tracker.
Veröffentlicht am 2026-09-10: die Notiz bezeichnet es als „das kleinste Modell unserer neuen Architektur-Familie“ mit nativem visuellem Verständnis. Auf QCode als deepseek-v4.1-flash, 1M / 384K, zwei Spitzen-/Nebenzeiten-Tarife. Leitfaden unter /deepseek-v4-1-flash-guide.
Stand 2026-09-29. Verfügbarkeit und Benchmarks ändern sich schnell; Vorschau-, Verzögert- und Gerüchte-Einträge sind gekennzeichnet.
✅ Was Sie auf QCode jetzt sofort nutzen können
Ein API-Key, mehrere Modellfamilien — wählen Sie die Modelle, die heute tatsächlich live sind.
Claude Fable 5.1
Anthropics Tabelle verzeichnet releasedOn 2026-09-01, Lifecycle aktiv. Auf QCode als claude-fable-5-1 verfügbar.
GPT-6 Astra
Ausgeliefert am 2026-09-03 als gpt-6-astra, Listenpreis $10/$50. Codex ruft diese ID direkt auf; hier besteht echter 30-Tage-Traffic.
DeepSeek V4.1 Flash
Steht in unserem /models: deepseek-v4.1-flash (2026-09-10, das laut DeepSeek das kleinste Modell in seiner neuen Architektur-Familie ist).
So erhalten Sie neue Modelle in dem Moment, in dem sie freigeschaltet werden
Erstellen Sie ein QCode-Konto — die Registrierung selbst kostet nichts. Solange Ihr Tarif aktiv ist, schalten wir neue Modelle für Sie frei, sobald sie verfügbar werden: keine zusätzliche Registrierung, kein API-Key-Wechsel. Dasselbe Guthaben und derselbe API-Key funktionieren über Claude, Codex und chinesische Modelle.
Häufig gestellte Fragen
Kann ich GPT-5.6, Fable 5 oder Gemini 3.5 Pro heute auf QCode nutzen?
GPT-5.6: ja — es wurde am 9. Juli GA; über QCode aufrufbar sind gpt-5.6-sol und gpt-5.6-terra, Luna unterstützt QCode derzeit nicht (gpt-5.6-luna wurde aus /models entfernt) – bitte nutzen Sie ein anderes GPT-Modell. Claude Fable 5: ja über die API (unser Pfad wurde am 15. Juli wiedereröffnet), während Anthropics eigene Abonnements es seit dem 19. Juli nach Tarif staffeln. Gemini 3.5 Pro befindet sich noch in der Enterprise-Vorschau; QCode bietet die Gemini-Serie derzeit nicht an – bitte nutzen Sie Claude, GPT oder chinesische Modelle. Claude Opus 4.8 und Codex (GPT-5.6) sind ebenfalls live.
Warum wurde Claude Fable 5 offline genommen?
Zwei verschiedene Dinge. Erstens: Upstream-Verfügbarkeit — Anthropic hat Fable 5 und Mythos 5 am 12. Juni 2026 weltweit ausgesetzt, um einer US-Exportkontrollvorgabe zu entsprechen (andere Claude-Modelle waren nicht betroffen); der Fable-5-Zugang wurde am 15. Juli wiederhergestellt und ist auf QCode wieder verfügbar, während Mythos 5 weiterhin nur für zugelassene Organisationen begrenzt ist. Zweitens: Abonnementregeln — seit dem 19. Juli staffelt Anthropic Fable 5 auf den eigenen Tarifen: standardmäßig auf Max sowie auf Team-/Enterprise-Premium-Plätzen, nutzungsabhängige Guthaben auf Pro- und Standard-Team-Plätzen. Die API und verbrauchsbasierte Enterprise-Tarife sind von Punkt zwei nicht betroffen.
Welches Modell 2026 ist das beste für Coding?
Stand beim vorherigen Durchlauf dieser Seite (2026-09-18): GPT-5.6 Sol führte beim terminalen agentischen Coding mit 88,8 % auf Terminal-Bench 2.1, und Claude Opus 4.8 war der übliche Maßstab für tiefgreifende Refactors und urteilsintensive Aufgaben. Seit dem 2026-09-29 bietet QCode zwei weitere Coding-Empfehlungen: Claude Opus 5.5 (claude-opus-5-5, veröffentlicht am 2026-09-22, $4/$20) und GPT-6 Sol (gpt-6-sol, veröffentlicht am 2026-09-22, $2/$10). Die selbstberichteten Benchmarks in den Veröffentlichungsbeiträgen werden hier nicht übernommen. GLM-5.2 bleibt unter den stärksten Open-Weight-Modellen, und QCode /models listet glm-5.2. Wir halten dieses Radar mit neuen Benchmarks aktuell.
Fügt QCode neue Modelle automatisch hinzu?
Ja. Wenn ein Modell breit verfügbar wird und wir Kapazität gesichert haben, aktivieren wir es für alle Konten — Ihr vorhandener API-Key und Ihr Guthaben funktionieren sofort. Beispiel: Claude Haiku 5.5 wurde am 2026-10-07 unter der Modell-ID claude-haiku-5-5 veröffentlicht und ist bei QCode bereits verfügbar; Sie rufen es mit dem vorhandenen Key auf, indem Sie model auf claude-haiku-5-5 setzen; die Preise stehen auf /models. Ein weiteres Haiku im Angebot ist claude-haiku-4-5-20251001 ($1/$5), mit Außerdienststellung „frühestens am 2026-10-15“ — der frühestmögliche Tag, kein Abschalttermin.
Seien Sie bei jedem 2026-Launch als Erster dabei
Aktivieren Sie einen Tarif ab $8.57/Monat und nutzen Sie Claude, Codex und chinesische Modelle noch heute — neue Modelle werden für denselben API-Key in dem Moment freigeschaltet, in dem sie verfügbar werden.
Mehr erfahren
DeepSeek V4.1 Flash vs V4 Pro
DeepSeek behauptet, Flash sei Pro in mehreren Punkten überlegen, doch der Changelog-Eintrag vom 2026-09-10 hat die Pro-Umleitung zurückgenommen (mit der Angabe, dass sie nach dem 2026-09-14 fortbesteht) — so wählen Sie nach Preis, Parallelität und Vision.
GPT-6 Sol Status-Tracker
GPT-6 Sol wurde am 2026-09-22 von OpenAI offiziell veröffentlicht: ID gpt-6-sol, $2 / $10, 1,050,000 Kontext; auf QCode mit demselben API-Key aufrufbar.
DeepSeek V4.1 Flash Preis-Tracker
Sechs Tarife, Cache-Treffer 1/50, Spitzen-/Nebenzeiten für Peking, Tokio und Moskau umgerechnet, plus die Differenz zu V4 Pro.
Leitfaden zur Modellaufstellung im KI-Coding-Bereich H2 2026
Ein Entscheidungsrahmen nach Budget, Komplexität und Kontext, plus der komplette Inhalt der Modellaufstellung der Website.