Resumen del modelo
Aquí todo se reduce a una duplicación: $1.90 por millón de tokens de input en lugar de $0.95, $8 de output en lugar de $4, $0.38 en aciertos de caché en lugar de $0.19. Nada más cambia. La ventana se mantiene en 262,144 tokens, y el razonamiento, las herramientas, la entrada multimodal y la caché de contexto son iguales que en la ficha Code estándar. Lo que compra el recargo es rendimiento de servicio, lo que convierte esto en una cuestión de latencia y no de capacidad. Se amortiza en editores interactivos, interfaces de chat y bucles de agente donde el tiempo real tiene un coste propio, y juega en contra en trabajos por lotes o evaluaciones nocturnas donde una cola absorbe el retraso. Presupuesta el doble y luego mide si la respuesta más rápida cambia algo aguas abajo.
Condiciones de facturación: Standard Kimi API price. Cache-miss input is shown as Input; automatic cache-hit input is shown as Cached input.
- Ventana de contexto
- 262.144 tokens
- Corte de conocimiento
- —
- Última verificación del precio
- Primera observación
Las descripciones, capacidades y tarifas proceden de la fuente enlazada. Los precios oficiales tienen prioridad y los complementos de OpenRouter se indican.