So rufen Sie Kimi K3 auf
2.8T · 1M · Thinking lässt sich nicht abschalten
Moonshot hat Kimi K3 am 16. Juli 2026 veröffentlicht. Offizielle API: $3 bei Cache-Miss / $0.30 bei Cache-Treffer / $15 Output pro Million Tokens, einheitlich über das gesamte 1M-Fenster. Modell-ID: kimi-k3. QCode /models listet es. Die Status-Tracker-Seite und die Seite „vs Opus 5“ gibt es bereits – dies ist die Anleitung.
Aktualisiert 2026-08-16
Claude, GPT und chinesische Modelle mit einem Key, Bezahlung pro Token; verfügbare Modelle unter /models.
- Bezahlung pro Token — aktuelle Preise unter /models
- Zahlung per Karte (Visa / Mastercard / AMEX), Apple Pay, Google Pay oder Krypto
- Selbstbedienung: aufladen und sofort aktivieren
Vier Zahlen vor dem Aufruf
Größe
Offiziell: 2.8T, native Vision, KDA + Attention Residuals. Moonshot nennt es das erste offene Modell der 3T-Klasse und räumt zugleich ein, dass es hinter Fable 5 und GPT-5.6 Sol zurückliegt – das ist die eigene Positionierung des Anbieters.
Kontext
Offizielles Fenster von 1,000,000 Tokens. Der API-Tarif ist über dieses gesamte Fenster einheitlich. In der offiziellen Tabelle ist kein Aufschlag für Kontextlänge angegeben.
Offizielle API / Million
Cache-Miss $3, Cache-Treffer $0.30, Output $15. Quelle: platform.kimi.ai. Gleiche Preisstufe über das gesamte 1M-Fenster.
CoT lässt sich nicht deaktivieren
Offizielle FAQ: Das geht nicht – K3 denkt immer. Übergeben Sie keinen thinking-Parameter. reasoning_effort ist low / high / max, Standard ist max.
Was K3 ist
Moonshots Flaggschiff-Thinking-Modell. Der Launch-Blog bewirbt Coding über lange Zeithorizonte, Wissensarbeit und Reasoning, mit nativer Multimodalität. Zum Launch war max Thinking voreingestellt; spätere Dokumente ergänzten low / high / max. Das Thinking selbst lässt sich weiterhin nicht abschalten. Die Gewichte wurden für Ende Juli unter Modified MIT zugesagt – ob sie heute herunterladbar sind, ist eine Prüfung auf Hugging Face und kein Satz, den wir als Tatsache formulieren.
Verwechseln Sie dies nicht mit den beiden anderen Seiten
/kimi-k3-status-tracker verfolgt, was bestätigt ist. /kimi-k3-vs-claude-opus-5 ist der Vergleich. Diese Seite behandelt nur den Aufruf: ID, Preis, Thinking, Fenster und wie wir über die Gewichte-Zusage sprechen. Preise von Drittanbieter-Resellern sind nicht die offizielle Tabelle.
Zeitleiste
Kimi K3 startet auf kimi.com / Kimi Work / Kimi Code / platform.kimi.ai. ID kimi-k3.
Offizielle Zusage der vollständigen Gewichte (Modified MIT). Diese Seite behauptet nicht, dass sie heute herunterladbar sind. Prüfen Sie Hugging Face.
Anleitung. QCode /models listet kimi-k3. Die Abrechnung erfolgt nach offiziellem Listenpreis × Servicesatz.
Bestätigt vs. mit Vorsicht behandeln
Bestätigt
Veröffentlichung am 16. Juli 2026; 2.8T; 1M Kontext; native Vision; ID kimi-k3; offiziell $3 / $0.30 / $15; Thinking immer aktiv; Effort low / high / max, Standard max. Quellen: kimi.com/blog/kimi-k3 und platform.kimi.ai.
Mit Vorsicht behandeln
Schreiben Sie nicht „Open Weights heute“, ohne zugleich auf die Prüfung bei HF hinzuweisen – die Zusage galt für Ende Juli. Behandeln Sie den Preis eines Resellers nicht als Moonshots Tarif. Erfinden Sie keinen unabhängigen Rang. Moonshot selbst sagt, dass es weiterhin hinter Fable 5 und GPT-5.6 Sol liegt.
Gehostete API oder Self-Hosting
Die API aufrufen
model=kimi-k3. Preis $3 / $0.30 / $15. Thinking lässt sich nicht deaktivieren; nur reasoning_effort ist verstellbar. QCode listet diese ID.
Sie möchten die Gewichte
Zugesagt war Modified MIT, Ende Juli. Ob sie verfügbar sind, ist eine Prüfung auf Hugging Face. Eine Zusage im Blog ist keine Download-URL.
So rufen Sie es auf
Wählen Sie kimi-k3 auf der offiziellen Plattform. Übergeben Sie kein thinking; damit schalten Sie das Reasoning nicht ab. Um die Traces zu verkürzen, setzen Sie reasoning_effort auf low. Offizieller Hinweis: K3 reagiert empfindlich auf den Thinking-Verlauf – ein Modellwechsel mitten in der Sitzung oder das Weglassen früherer Gedanken kann die Qualität instabil machen. Moonshot gibt an, dass bei Coding-Workloads oft Cache-Trefferquoten von über 90% erreicht werden.
Auf QCode
QCode /models listet kimi-k3. Wir rechnen nach offiziellem Listenpreis × Servicesatz ab. Dies ist eine Anleitung, kein Teaser für ein nicht vorhandenes SKU. Der aktuelle Bestand ist das, was diese Seite anzeigt.
FAQ zur Kimi-K3-Anleitung
Wie lautet die Modell-ID?
kimi-k3. Das ist die Zeichenfolge auf der offiziellen API-Plattform und unter QCode /models.
Kann ich Chain-of-Thought abschalten?
Nein. Offizieller Wortlaut: Das geht nicht – K3 denkt immer. Wenn es zu lange läuft, setzen Sie reasoning_effort auf low. Übergeben Sie keinen thinking-Parameter.
Wie lautet der offizielle Preis?
Pro Million Tokens: $3 bei Cache-Miss, $0.30 bei Cache-Treffer, $15 für Output. Einheitlich über das 1M-Fenster. Quelle: platform.kimi.ai.
Sind die Gewichte herunterladbar?
Sie wurden für Ende Juli unter Modified MIT zugesagt. Diese Seite behauptet nicht, dass sie heute herunterladbar sind. Prüfen Sie Hugging Face auf eine Model Card.
Kann ich es auf QCode aufrufen?
Ja. /models listet kimi-k3. Abbuchung = offizieller Listenpreis × Servicesatz.
Wie unterscheidet sich das vom Tracker und der Vergleichsseite?
Der Tracker zeigt den Bestätigungsstatus. Die Vergleichsseite behandelt Opus 5. Diese Seite zeigt nur, wie Sie K3 aufrufen. Übernehmen Sie Spezifikationen nicht seitenübergreifend als neue Schlussfolgerungen.
Quellen
kimi.com/blog/kimi-k3; platform.kimi.ai Kimi-K3-Schnellstart, Thinking-Modelle und Preise. Zusage zu den Gewichten gemäß Wortlaut im Blog von Ende Juli; Downloads laut Hugging Face.
Die ID lautet kimi-k3
Sie ist gelistet. Thinking bleibt aktiv. Der Preis folgt der offiziellen Tabelle.
Verwandt
K3-Status-Tracker
Was veröffentlicht wurde und was bestätigt ist.
K3 vs. Claude Opus 5
Der Vergleich. Wir ordnen ihn hier nicht neu.
Kimi-Work-Leitfaden
Der Desktop-Workflow – nicht diese API-ID.
Nicht mit Moonshot / Kimi verbunden. Die Preise stammen aus der offiziellen API-Dokumentation. Ob Gewichte herunterladbar sind, ist eine Tatsache, die auf Hugging Face zu prüfen ist.