Présentation du modèle
deepseek-v4-flash est le moins cher des deux paliers publiés par DeepSeek : $0.44 par million de tokens en input et $1.32 en output, soit exactement le tiers de ce que facture le palier Pro des deux côtés. Les deux modèles annoncent la même fenêtre de contexte de 1M tokens et le même ensemble de fonctionnalités — raisonnement, appels d'outils, sortie structurée et fill-in-the-middle — si bien que le choix entre eux relève du prix et non des capacités. Les hits de cache sont facturés $0.014, environ un trentième du tarif hors cache, ce qui compte pour des prompts répétés partageant un long préfixe. Les tarifs ci-dessus sont ceux des heures pleines : DeepSeek les divise tous par deux en dehors des créneaux 01:00-04:00 et 06:00-10:00 UTC.
Conditions de facturation : Standard peak price. Cache-miss input is shown as Input; cache-hit input is shown as Cached input. DeepSeek halves every rate off-peak.
- Fenêtre de contexte
- 1 000 000 tokens
- Fin des connaissances
- —
- Dernière vérification du tarif
- Première observation
Les descriptions, capacités et tarifs proviennent de la source liée. Les prix officiels sont prioritaires ; les compléments OpenRouter sont signalés.