Modellübersicht
Hier geht es allein um eine Verdopplung: $1.90 pro Million Input-Tokens statt $0.95, $8 im Output statt $4, $0.38 bei Cache-Treffern statt $0.19. Sonst bewegt sich nichts. Das Fenster bleibt bei 262,144 Tokens, und Reasoning, Tools, multimodale Eingabe und Context Caching sind gegenüber dem Standard-Code-Eintrag unverändert. Der Aufschlag kauft Durchsatz beim Ausliefern, womit dies eine Frage der Latenz und nicht der Fähigkeiten ist. Er lohnt sich in interaktiven Editoren, Chat-Oberflächen und Agenten-Schleifen, in denen die reale Wartezeit eigene Kosten trägt, und spricht gegen sich in Batch-Jobs oder nächtlichen Evaluationsläufen, in denen eine Warteschlange die Verzögerung auffängt. Planen Sie das Doppelte ein und messen Sie dann, ob die schnellere Antwort nachgelagert überhaupt etwas ändert.
Abrechnungsbedingungen: Standard Kimi API price. Cache-miss input is shown as Input; automatic cache-hit input is shown as Cached input.
- Kontextfenster
- 262.144 tokens
- Wissensstand
- —
- Preis zuletzt geprüft
- Erstmals beobachtet
Beschreibungen, Fähigkeiten und Tarife stammen aus der verlinkten Quelle. Offizielle Preise haben Vorrang; OpenRouter-Ergänzungen sind gekennzeichnet.