Kimi K3 ist offiziell verfügbar
Bestätigt vs. Gerücht
Stand 2026-10-07 bezeichnet Moonshot Kimi K3 als sein bislang leistungsfähigstes Kimi-Modell: offiziell veröffentlicht am 2026-07-16, offizielle API $3 / $15 pro 1 Mio. Tokens, und in der offiziellen Modellliste gibt es noch kein K4. Diese Seite verfolgt weiterhin, was offiziell bestätigt ist und was weiterhin nur Behauptung der Community bleibt.
Aktueller Status (aktualisiert 2026-10-07)
Stand 2026-10-07: Kimi K3 wurde am 2026-07-16 offiziell gelauncht, die Gewichte wurden am 07-27 open-source veröffentlicht (2,8 Bio. Stable LatentMoE — das größte Open-Weight-Modell aller Zeiten). Die offizielle Modellliste von Moonshot beschreibt kimi-k3 als bislang leistungsfähigstes Kimi-Modell mit 2,8 Billionen Parametern, nativem Bildverständnis und 1 Mio. Tokens Kontext. Offizielle API-Preise pro 1 Mio. Tokens: $3 Input, $15 Output, $0,30 für gecachten Input, Kontext 1.048.576 Tokens. Der offizielle Plattform-Changelog meldet im Eintrag für Juli 2026 Kimi K3 als in der Open-Platform-API verfügbar, der jüngste Eintrag stammt aus September 2026, und Moonshots neuestes Release auf Hugging Face ist weiterhin Kimi-K3. QCode /models listet bereits kimi-k3 mit tatsächlichen Aufrufen in den letzten 30 Tagen.
Bestätigt vs. Community-Gerücht
Offiziell bestätigt
Veröffentlichungsdatum 2026-07-16; Gewichte am 07-27 open-source (2,8 Bio. — größte Open Weights aller Zeiten); 1 Mio.-Token-Kontext; offizieller API-Preis $3/$15; Coding ist einer der Hauptanwendungsfälle. Stand 2026-10-07 nennt die offizielle Preisseite außerdem $0,30 pro 1 Mio. gecachter Input-Tokens; Cache-Schreibvorgänge werden nach TTL abgerechnet ($3 für 5 Minuten, $6 für 1 Stunde).
Noch nicht vollständig bestätigt
Klargestellt: Die Parameteranzahl (2,8 Bio.), die Open-Source-Veröffentlichung der Gewichte am 07-27 und die offizielle API-Preisgestaltung ($3/$15) wurden alle veröffentlicht. Die nächste Generation K4 hat das Training begonnen (mehrere Medienberichte am 07-29) — kein Datum, keine Spezifikationen. Offizieller Abgleich Stand 2026-10-07: K4 taucht weder in Moonshots Modellliste (Englisch und Chinesisch) noch im Plattform-Changelog (jüngster Eintrag September 2026) noch auf der Hugging-Face-Organisationsseite auf. QCode rechnet pro Token ab; die Preise je Modell stehen unter /models.
Warum Kimi K3 beobachten
Für chinesische Entwickler sind zusätzliche starke Long-Context-Optionen für Agent-Workflows relevant. Die Diversifizierung der Anbieter hilft, wenn ein einzelnes Kontingentfenster enger wird.
Wie Kimi K3 in die 2026-Landschaft passt
Vs. GLM-5.2
Unterschiedliches Training, Closed-vs.-Open-Weights-Abwägungen. Beobachten Sie beide.
Vs. GPT Long Context
Chinesisches Ökosystem und Kostenprofil können unterschiedlich ausfallen.
Anbieter-Hedge
Eine weitere Option, wenn Claude- oder Codex-Kontingentfenster enger werden.
Zugriff über QCode heute
kimi-k3 ist über QCode mit demselben Key aufrufbar wie die übrigen Modelle unter /models; abgerechnet wird pro Token, die Preise je Modell stehen unter /models. Stand 2026-10-07 findet sich Kimi K4 weder in Moonshots offizieller Modellliste noch im Changelog oder auf Hugging Face, und QCode bietet es nicht an.
Veröffentlichungsdatum 2026-07-16; Gewichte am 07-27 open-source (2,8 Bio. — größte Open Weights aller Zeiten); 1 Mio.-Token-Kontext; offizieller API-Preis $3/$15; Coding ist einer der Hauptanwendungsfälle. Stand 2026-10-07 nennt die offizielle Preisseite außerdem $0,30 pro 1 Mio. gecachter Input-Tokens; Cache-Schreibvorgänge werden nach TTL abgerechnet ($3 für 5 Minuten, $6 für 1 Stunde).
Klargestellt: Die Parameteranzahl (2,8 Bio.), die Open-Source-Veröffentlichung der Gewichte am 07-27 und die offizielle API-Preisgestaltung ($3/$15) wurden alle veröffentlicht. Die nächste Generation K4 hat das Training begonnen (mehrere Medienberichte am 07-29) — kein Datum, keine Spezifikationen. Offizieller Abgleich Stand 2026-10-07: K4 taucht weder in Moonshots Modellliste (Englisch und Chinesisch) noch im Plattform-Changelog (jüngster Eintrag September 2026) noch auf der Hugging-Face-Organisationsseite auf. QCode rechnet pro Token ab; die Preise je Modell stehen unter /models.
Für chinesische Entwickler sind zusätzliche starke Long-Context-Optionen für Agent-Workflows relevant. Die Diversifizierung der Anbieter hilft, wenn ein einzelnes Kontingentfenster enger wird.
Stand 2026-10-07: Kimi K3 wurde am 2026-07-16 offiziell gelauncht, die Gewichte wurden am 07-27 open-source veröffentlicht (2,8 Bio. Stable LatentMoE — das größte Open-Weight-Modell aller Zeiten). Die offizielle Modellliste von Moonshot beschreibt kimi-k3 als bislang leistungsfähigstes Kimi-Modell mit 2,8 Billionen Parametern, nativem Bildverständnis und 1 Mio. Tokens Kontext. Offizielle API-Preise pro 1 Mio. Tokens: $3 Input, $15 Output, $0,30 für gecachten Input, Kontext 1.048.576 Tokens. Der offizielle Plattform-Changelog meldet im Eintrag für Juli 2026 Kimi K3 als in der Open-Platform-API verfügbar, der jüngste Eintrag stammt aus September 2026, und Moonshots neuestes Release auf Hugging Face ist weiterhin Kimi-K3. QCode /models listet bereits kimi-k3 mit tatsächlichen Aufrufen in den letzten 30 Tagen.
Veröffentlichungsdatum 2026-07-16; Gewichte am 07-27 open-source (2,8 Bio. — größte Open Weights aller Zeiten); 1 Mio.-Token-Kontext; offizieller API-Preis $3/$15; Coding ist einer der Hauptanwendungsfälle. Stand 2026-10-07 nennt die offizielle Preisseite außerdem $0,30 pro 1 Mio. gecachter Input-Tokens; Cache-Schreibvorgänge werden nach TTL abgerechnet ($3 für 5 Minuten, $6 für 1 Stunde).
Klargestellt: Die Parameteranzahl (2,8 Bio.), die Open-Source-Veröffentlichung der Gewichte am 07-27 und die offizielle API-Preisgestaltung ($3/$15) wurden alle veröffentlicht. Die nächste Generation K4 hat das Training begonnen (mehrere Medienberichte am 07-29) — kein Datum, keine Spezifikationen. Offizieller Abgleich Stand 2026-10-07: K4 taucht weder in Moonshots Modellliste (Englisch und Chinesisch) noch im Plattform-Changelog (jüngster Eintrag September 2026) noch auf der Hugging-Face-Organisationsseite auf. QCode rechnet pro Token ab; die Preise je Modell stehen unter /models.
Für chinesische Entwickler sind zusätzliche starke Long-Context-Optionen für Agent-Workflows relevant. Die Diversifizierung der Anbieter hilft, wenn ein einzelnes Kontingentfenster enger wird.
Stand 2026-10-07: Kimi K3 wurde am 2026-07-16 offiziell gelauncht, die Gewichte wurden am 07-27 open-source veröffentlicht (2,8 Bio. Stable LatentMoE — das größte Open-Weight-Modell aller Zeiten). Die offizielle Modellliste von Moonshot beschreibt kimi-k3 als bislang leistungsfähigstes Kimi-Modell mit 2,8 Billionen Parametern, nativem Bildverständnis und 1 Mio. Tokens Kontext. Offizielle API-Preise pro 1 Mio. Tokens: $3 Input, $15 Output, $0,30 für gecachten Input, Kontext 1.048.576 Tokens. Der offizielle Plattform-Changelog meldet im Eintrag für Juli 2026 Kimi K3 als in der Open-Platform-API verfügbar, der jüngste Eintrag stammt aus September 2026, und Moonshots neuestes Release auf Hugging Face ist weiterhin Kimi-K3. QCode /models listet bereits kimi-k3 mit tatsächlichen Aufrufen in den letzten 30 Tagen.
Veröffentlichungsdatum 2026-07-16; Gewichte am 07-27 open-source (2,8 Bio. — größte Open Weights aller Zeiten); 1 Mio.-Token-Kontext; offizieller API-Preis $3/$15; Coding ist einer der Hauptanwendungsfälle. Stand 2026-10-07 nennt die offizielle Preisseite außerdem $0,30 pro 1 Mio. gecachter Input-Tokens; Cache-Schreibvorgänge werden nach TTL abgerechnet ($3 für 5 Minuten, $6 für 1 Stunde).
Klargestellt: Die Parameteranzahl (2,8 Bio.), die Open-Source-Veröffentlichung der Gewichte am 07-27 und die offizielle API-Preisgestaltung ($3/$15) wurden alle veröffentlicht. Die nächste Generation K4 hat das Training begonnen (mehrere Medienberichte am 07-29) — kein Datum, keine Spezifikationen. Offizieller Abgleich Stand 2026-10-07: K4 taucht weder in Moonshots Modellliste (Englisch und Chinesisch) noch im Plattform-Changelog (jüngster Eintrag September 2026) noch auf der Hugging-Face-Organisationsseite auf. QCode rechnet pro Token ab; die Preise je Modell stehen unter /models.
Warum Kimi K3 beobachten
Für chinesische Entwickler sind zusätzliche starke Long-Context-Optionen für Agent-Workflows relevant. Die Diversifizierung der Anbieter hilft, wenn ein einzelnes Kontingentfenster enger wird.
Stand 2026-10-07: Kimi K3 wurde am 2026-07-16 offiziell gelauncht, die Gewichte wurden am 07-27 open-source veröffentlicht (2,8 Bio. Stable LatentMoE — das größte Open-Weight-Modell aller Zeiten). Die offizielle Modellliste von Moonshot beschreibt kimi-k3 als bislang leistungsfähigstes Kimi-Modell mit 2,8 Billionen Parametern, nativem Bildverständnis und 1 Mio. Tokens Kontext. Offizielle API-Preise pro 1 Mio. Tokens: $3 Input, $15 Output, $0,30 für gecachten Input, Kontext 1.048.576 Tokens. Der offizielle Plattform-Changelog meldet im Eintrag für Juli 2026 Kimi K3 als in der Open-Platform-API verfügbar, der jüngste Eintrag stammt aus September 2026, und Moonshots neuestes Release auf Hugging Face ist weiterhin Kimi-K3. QCode /models listet bereits kimi-k3 mit tatsächlichen Aufrufen in den letzten 30 Tagen.
Veröffentlichungsdatum 2026-07-16; Gewichte am 07-27 open-source (2,8 Bio. — größte Open Weights aller Zeiten); 1 Mio.-Token-Kontext; offizieller API-Preis $3/$15; Coding ist einer der Hauptanwendungsfälle. Stand 2026-10-07 nennt die offizielle Preisseite außerdem $0,30 pro 1 Mio. gecachter Input-Tokens; Cache-Schreibvorgänge werden nach TTL abgerechnet ($3 für 5 Minuten, $6 für 1 Stunde).
Klargestellt: Die Parameteranzahl (2,8 Bio.), die Open-Source-Veröffentlichung der Gewichte am 07-27 und die offizielle API-Preisgestaltung ($3/$15) wurden alle veröffentlicht. Die nächste Generation K4 hat das Training begonnen (mehrere Medienberichte am 07-29) — kein Datum, keine Spezifikationen. Offizieller Abgleich Stand 2026-10-07: K4 taucht weder in Moonshots Modellliste (Englisch und Chinesisch) noch im Plattform-Changelog (jüngster Eintrag September 2026) noch auf der Hugging-Face-Organisationsseite auf. QCode rechnet pro Token ab; die Preise je Modell stehen unter /models.
Kimi K3 FAQ
Ist K3 jetzt öffentlich nutzbar?
Ja. Seit dem 2026-07-16 können angemeldete Nutzer K3·Max und K3 Cluster·Max verwenden. Für API-Details folgen Sie den offiziellen Plattformdokumentationen von Moonshot.
Wie unterscheidet sich das von GLM-5.2 oder GPT Long Context?
Unterschiedliche Anbieter, unterschiedliche Trainingsdaten und Kontextbehandlung. Optionen zu haben ermöglicht Routing oder Fallback, wenn ein Anbieter unter Kontingentdruck steht.
Sollte ich auf K3 warten oder aktuelle Optionen nutzen?
Warten ist nicht nötig. K3 ist erschienen und der offizielle API-Preis ist öffentlich ($3 / $15 pro 1 Mio. Tokens, Stand 2026-10-07). Testen Sie es also jetzt mit Ihren eigenen Aufgaben und vergleichen Sie vor dem Produktionseinsatz Kosten und Stabilität mit einem kleinen Teil Ihres Traffics. Aktuelle Claude- und GPT-Tarife bleiben die sichere Basis.
Wird QCode K3 bei Veröffentlichung unterstützen?
Bereits unterstützt. kimi-k3 ist unter /models mit tatsächlichen Aufrufen in den letzten 30 Tagen gelistet; die Preise folgen der Live-Liste.
Mit Multi-Provider-Zugriff vorbereitet bleiben
Ein QCode-Key für aktuelle Modelle; neue Modelle werden bei Verfügbarkeit ergänzt.
Ähnliches
Kimi K3 vs. Claude Opus 5
Überlappende Benchmark-Bereiche, ein Preisunterschied von etwa 40 % und wie Moonshot das Modell positioniert.
GLM-5.2 im Detail
Das stärkste Open-Weight-Coding-Modell — Fähigkeiten, Benchmarks und Einschränkungen.
AI Model Radar 2026
Unser eigener zusammengesetzter Modellvergleich, nützlich zur Querverifizierung gegen den AA Index.