Visão geral do modelo
deepseek-v4-flash é o mais barato dos dois escalões publicados pela DeepSeek: $0.44 por milhão de tokens de input e $1.32 de output, exatamente um terço do que o escalão Pro cobra de ambos os lados. Os dois modelos declaram a mesma janela de contexto de 1M tokens e o mesmo conjunto de funcionalidades — raciocínio, chamadas de ferramentas, output estruturado e fill-in-the-middle —, pelo que a escolha entre eles é uma decisão de preço e não de capacidade. Os acertos de cache são faturados a $0.014, cerca de um trigésimo da tarifa sem cache, o que conta em prompts repetidos que partilham um prefixo longo. As tarifas acima são de hora de ponta: a DeepSeek reduz todas para metade fora das janelas 01:00-04:00 e 06:00-10:00 UTC.
Condições de faturação: Standard peak price. Cache-miss input is shown as Input; cache-hit input is shown as Cached input. DeepSeek halves every rate off-peak.
- Janela de contexto
- 1.000.000 tokens
- Limite de conhecimento
- —
- Última verificação do preço
- Primeira observação
As descrições, capacidades e tarifas vêm da fonte associada. Os preços oficiais têm prioridade e os complementos OpenRouter são assinalados.