Resumen del modelo
deepseek-v4-flash es el más barato de los dos niveles publicados por DeepSeek: $0.44 por millón de tokens de input y $1.32 de output, exactamente un tercio de lo que cobra el nivel Pro en ambos lados. Los dos modelos declaran la misma ventana de contexto de 1M tokens y el mismo conjunto de funciones — razonamiento, llamadas a herramientas, salida estructurada y fill-in-the-middle —, así que elegir entre ellos es una decisión de precio y no de capacidad. Los aciertos de caché se facturan a $0.014, alrededor de una treintava parte de la tarifa sin caché, lo que importa en prompts repetidos que comparten un prefijo largo. Las tarifas anteriores son de hora punta: DeepSeek reduce todas a la mitad fuera de las franjas 01:00-04:00 y 06:00-10:00 UTC.
Condiciones de facturación: Standard peak price. Cache-miss input is shown as Input; cache-hit input is shown as Cached input. DeepSeek halves every rate off-peak.
- Ventana de contexto
- 1.000.000 tokens
- Corte de conocimiento
- —
- Última verificación del precio
- Primera observación
Las descripciones, capacidades y tarifas proceden de la fuente enlazada. Los precios oficiales tienen prioridad y los complementos de OpenRouter se indican.