Présentation du modèle
On achète K3 pour sa fenêtre : 1,048,576 tokens, quatre fois les 262,144 partagés par tous les autres modèles de la gamme, si bien qu'un dépôt entier ou une longue trace d'agent peut rester en mémoire au lieu d'être découpé en plusieurs passes. Cette portée se paie. L'input coûte $3 par million contre $0.95 sur le palier coding K2.7, et l'output $15 contre $4, soit environ trois fois et près de quatre fois plus. L'input mis en cache à $0.30 représente un dixième du tarif hors cache, la remise de cache la plus forte de la gamme, ce qui garde un grand préfixe fixe abordable sur de nombreux tours. Le raisonnement, l'appel d'outils, l'entrée multimodale et le cache de contexte sont présents dans toute la gamme : le supplément achète donc la taille de la fenêtre, pas une capacité exclusive.
Conditions de facturation : Standard Kimi API price. Cache-miss input is shown as Input; automatic cache-hit input is shown as Cached input.
- Fenêtre de contexte
- 1 048 576 tokens
- Fin des connaissances
- —
- Dernière vérification du tarif
- Première observation
Les descriptions, capacités et tarifs proviennent de la source liée. Les prix officiels sont prioritaires ; les compléments OpenRouter sont signalés.