Panoramica del modello
Pagare tre volte di più per token non compra sulla carta né contesto né capacità in più: deepseek-v4-pro dichiara la stessa finestra da 1M token e lo stesso supporto per reasoning, chiamate a strumenti, output strutturato e fill-in-the-middle del livello più economico, a $1.32 per milione di token di input e $3.96 di output. Un riferimento aiuta a misurare il divario — $1.32 è anche quanto Flash fa pagare per generare un milione di token, quindi leggere qui un documento lungo costa quanto scriverlo là. L'input in cache scende a $0.044, trenta volte sotto la tariffa senza cache, perciò i cicli di agente ricchi di prefissi assorbono il sovrapprezzo meglio delle chiamate singole. Sono tariffe di punta; ognuna si dimezza al di fuori delle fasce 01:00-04:00 e 06:00-10:00 UTC.
Condizioni di fatturazione: Standard peak price. Cache-miss input is shown as Input; cache-hit input is shown as Cached input. DeepSeek halves every rate off-peak.
- Finestra di contesto
- 1.000.000 tokens
- Limite delle conoscenze
- —
- Ultima verifica del prezzo
- Prima osservazione
Descrizioni, funzionalità e tariffe provengono dalla fonte collegata. I prezzi ufficiali hanno priorità e le integrazioni OpenRouter sono indicate.