Modeloverzicht
Drie keer meer per token betalen levert op papier geen extra context of capaciteit op: deepseek-v4-pro vermeldt hetzelfde venster van 1M tokens en dezelfde ondersteuning voor reasoning, tool calls, gestructureerde output en fill-in-the-middle als het goedkopere niveau, tegen $1.32 per miljoen input-tokens en $3.96 voor output. Eén ijkpunt helpt het verschil te plaatsen — $1.32 is ook wat Flash rekent om een miljoen tokens te genereren, dus een lang document hier lezen kost wat het daar schrijven zou kosten. Gecachte input zakt naar $0.044, dertig keer onder het tarief zonder cache, waardoor prefixzware agent-loops de meerprijs beter opvangen dan losse aanroepen. Dit zijn piektarieven; elk daarvan halveert buiten de vensters 01:00-04:00 en 06:00-10:00 UTC.
Factureringsvoorwaarden: Standard peak price. Cache-miss input is shown as Input; cache-hit input is shown as Cached input. DeepSeek halves every rate off-peak.
- Contextvenster
- 1.000.000 tokens
- Kennisgrens
- —
- Prijs laatst geverifieerd
- Eerst waargenomen
Beschrijvingen, mogelijkheden en tarieven komen uit de gekoppelde bron. Officiële prijzen krijgen voorrang en OpenRouter-aanvullingen zijn gemarkeerd.