Panoramica del modello
deepseek-v4-flash è il più economico dei due livelli pubblicati da DeepSeek: $0.44 per milione di token di input e $1.32 di output, esattamente un terzo di quanto fa pagare il livello Pro su entrambi i fronti. I due modelli dichiarano la stessa finestra di contesto da 1M token e lo stesso insieme di funzioni — reasoning, chiamate a strumenti, output strutturato e fill-in-the-middle — quindi la scelta tra loro è una decisione di prezzo e non di capacità. Gli hit di cache sono fatturati $0.014, circa un trentesimo della tariffa senza cache, il che conta per prompt ripetuti che condividono un lungo prefisso. Le tariffe indicate sono quelle di punta: DeepSeek le dimezza tutte al di fuori delle fasce 01:00-04:00 e 06:00-10:00 UTC.
Condizioni di fatturazione: Standard peak price. Cache-miss input is shown as Input; cache-hit input is shown as Cached input. DeepSeek halves every rate off-peak.
- Finestra di contesto
- 1.000.000 tokens
- Limite delle conoscenze
- —
- Ultima verifica del prezzo
- Prima osservazione
Descrizioni, funzionalità e tariffe provengono dalla fonte collegata. I prezzi ufficiali hanno priorità e le integrazioni OpenRouter sono indicate.