Modeloverzicht
deepseek-v4-flash is de goedkoopste van de twee door DeepSeek gepubliceerde niveaus: $0.44 per miljoen input-tokens en $1.32 voor output, precies een derde van wat het Pro-niveau aan beide kanten rekent. Beide modellen vermelden hetzelfde contextvenster van 1M tokens en dezelfde functies — reasoning, tool calls, gestructureerde output en fill-in-the-middle — waardoor de keuze ertussen een prijsbeslissing is en geen capaciteitskwestie. Cache hits worden gefactureerd tegen $0.014, ongeveer een dertigste van het tarief zonder cache, wat telt bij herhaalde prompts met een lang gedeeld prefix. Bovenstaande tarieven gelden tijdens piekuren: DeepSeek halveert ze allemaal buiten de vensters 01:00-04:00 en 06:00-10:00 UTC.
Factureringsvoorwaarden: Standard peak price. Cache-miss input is shown as Input; cache-hit input is shown as Cached input. DeepSeek halves every rate off-peak.
- Contextvenster
- 1.000.000 tokens
- Kennisgrens
- —
- Prijs laatst geverifieerd
- Eerst waargenomen
Beschrijvingen, mogelijkheden en tarieven komen uit de gekoppelde bron. Officiële prijzen krijgen voorrang en OpenRouter-aanvullingen zijn gemarkeerd.