Présentation du modèle
Les tarifs affichés tombent exactement sur ceux du palier coding : $0.95 par million de tokens d'input, $4 en output, la même fenêtre de 262,144 tokens ; aucun calcul ne tranche donc ce choix. Les hits de cache sont le seul écart, $0.16 contre $0.19, trois cents de moins par million, ce qui ne se voit qu'au volume sur des préfixes très réutilisés. La séparation tient au périmètre. K2.6 est proposé pour un travail multimodal généraliste couvrant le suivi d'instructions, l'extraction, le dialogue et les tâches d'agent, là où le modèle plus récent est cadré étroitement sur la programmation. Le raisonnement, les appels d'outils et le cache de contexte sont là dans les deux cas. Pour un trafic mixte avec de la génération de code occasionnelle, le généraliste coûte autant que le spécialiste et vise le mélange que vous envoyez réellement.
Conditions de facturation : Standard Kimi API price. Cache-miss input is shown as Input; automatic cache-hit input is shown as Cached input.
- Fenêtre de contexte
- 262 144 tokens
- Fin des connaissances
- —
- Dernière vérification du tarif
- Première observation
Les descriptions, capacités et tarifs proviennent de la source liée. Les prix officiels sont prioritaires ; les compléments OpenRouter sont signalés.