Présentation du modèle
Tout se résume ici à un doublement : $1.90 par million de tokens d'input au lieu de $0.95, $8 en output au lieu de $4, $0.38 sur les hits de cache au lieu de $0.19. Rien d'autre ne bouge. La fenêtre reste à 262,144 tokens, et le raisonnement, les outils, l'entrée multimodale et le cache de contexte sont identiques à la fiche Code standard. Le supplément achète du débit de service, ce qui en fait une question de latence et non de capacité. Il se rentabilise dans les éditeurs interactifs, les interfaces de chat et les boucles d'agent où le temps réel a un coût propre, et se dessert dans les traitements par lots ou les évaluations nocturnes où une file d'attente absorbe le délai. Prévoyez le double, puis mesurez si la réponse plus rapide change quoi que ce soit en aval.
Conditions de facturation : Standard Kimi API price. Cache-miss input is shown as Input; automatic cache-hit input is shown as Cached input.
- Fenêtre de contexte
- 262 144 tokens
- Fin des connaissances
- —
- Dernière vérification du tarif
- Première observation
Les descriptions, capacités et tarifs proviennent de la source liée. Les prix officiels sont prioritaires ; les compléments OpenRouter sont signalés.