Visão geral do modelo
Pagar três vezes mais por token não compra, no papel, mais contexto nem mais capacidades: o deepseek-v4-pro publica a mesma janela de 1M tokens e o mesmo suporte a raciocínio, chamadas de ferramentas, output estruturado e fill-in-the-middle do escalão mais barato, a $1.32 por milhão de tokens de input e $3.96 de output. Uma referência ajuda a medir a diferença — $1.32 é também o que a Flash cobra para gerar um milhão de tokens, pelo que ler aqui um documento longo custa o que escrevê-lo custaria ali. O input em cache desce para $0.044, trinta vezes abaixo da tarifa sem cache, pelo que os ciclos de agente com muitos prefixos absorvem melhor o acréscimo do que as chamadas isoladas. Estas são tarifas de hora de ponta; todas passam para metade fora das janelas 01:00-04:00 e 06:00-10:00 UTC.
Condições de faturação: Standard peak price. Cache-miss input is shown as Input; cache-hit input is shown as Cached input. DeepSeek halves every rate off-peak.
- Janela de contexto
- 1.000.000 tokens
- Limite de conhecimento
- —
- Última verificação do preço
- Primeira observação
As descrições, capacidades e tarifas vêm da fonte associada. Os preços oficiais têm prioridade e os complementos OpenRouter são assinalados.