Panoramica del modello
Le tariffe dichiarate coincidono esattamente con quelle del livello coding: $0.95 per milione di token di input, $4 in output, la stessa finestra da 262,144 token, quindi nessun calcolo risolve questa scelta. I cache hit sono l'unica differenza, $0.16 contro $0.19, tre centesimi in meno per milione, cosa che si nota solo a volume su prefissi molto riutilizzati. La separazione è di ambito. K2.6 è proposto per lavoro multimodale generalista che copre il rispetto delle istruzioni, l'estrazione, il dialogo e i task di agente, mentre il fratello più recente è inquadrato strettamente sulla programmazione. Reasoning, chiamate di strumenti e context caching ci sono in entrambi i casi. Per traffico misto con generazione di codice occasionale, il generalista costa quanto lo specialista e punta alla miscela che invii davvero.
Condizioni di fatturazione: Standard Kimi API price. Cache-miss input is shown as Input; automatic cache-hit input is shown as Cached input.
- Finestra di contesto
- 262.144 tokens
- Limite delle conoscenze
- —
- Ultima verifica del prezzo
- Prima osservazione
Descrizioni, funzionalità e tariffe provengono dalla fonte collegata. I prezzi ufficiali hanno priorità e le integrazioni OpenRouter sono indicate.