Resumen del modelo
Pagar tres veces más por token no compra sobre el papel ni contexto ni capacidades adicionales: deepseek-v4-pro publica la misma ventana de 1M tokens y el mismo soporte de razonamiento, llamadas a herramientas, salida estructurada y fill-in-the-middle que el nivel más barato, a $1.32 por millón de tokens de input y $3.96 de output. Una referencia ayuda a medir la diferencia: $1.32 es también lo que cobra Flash por generar un millón de tokens, así que leer aquí un documento largo cuesta lo que costaría escribirlo allí. El input en caché baja a $0.044, treinta veces por debajo de la tarifa sin caché, de modo que los bucles de agente con muchos prefijos absorben el sobrecoste mejor que las llamadas puntuales. Son tarifas de hora punta; todas se reducen a la mitad fuera de las franjas 01:00-04:00 y 06:00-10:00 UTC.
Condiciones de facturación: Standard peak price. Cache-miss input is shown as Input; cache-hit input is shown as Cached input. DeepSeek halves every rate off-peak.
- Ventana de contexto
- 1.000.000 tokens
- Corte de conocimiento
- —
- Última verificación del precio
- Primera observación
Las descripciones, capacidades y tarifas proceden de la fuente enlazada. Los precios oficiales tienen prioridad y los complementos de OpenRouter se indican.