Présentation du modèle
Payer trois fois plus par token n'achète sur le papier ni contexte ni capacité supplémentaires : deepseek-v4-pro annonce la même fenêtre de 1M tokens et le même support du raisonnement, des appels d'outils, de la sortie structurée et du fill-in-the-middle que le palier moins cher, à $1.32 par million de tokens en input et $3.96 en output. Un repère aide à mesurer l'écart — $1.32, c'est aussi ce que Flash facture pour générer un million de tokens : lire ici un long document coûte ce que l'écrire coûterait là-bas. L'input mis en cache tombe à $0.044, trente fois sous le tarif hors cache, si bien que les boucles d'agent riches en préfixes absorbent mieux le surcoût que les appels ponctuels. Ce sont les tarifs des heures pleines ; chacun est divisé par deux en dehors des créneaux 01:00-04:00 et 06:00-10:00 UTC.
Conditions de facturation : Standard peak price. Cache-miss input is shown as Input; cache-hit input is shown as Cached input. DeepSeek halves every rate off-peak.
- Fenêtre de contexte
- 1 000 000 tokens
- Fin des connaissances
- —
- Dernière vérification du tarif
- Première observation
Les descriptions, capacités et tarifs proviennent de la source liée. Les prix officiels sont prioritaires ; les compléments OpenRouter sont signalés.