Resumen del modelo
La deliberación antes de responder es lo único que distingue a este build, porque el contador no se mueve: $1.25 por millón de tokens de input, $0.20 en cache y $2.50 de output son idénticos a los de su gemelo non-reasoning, al build multiagente y a grok-4-3, todos sobre la misma ventana de 1,000,000 de tokens. La diferencia de coste vive, por tanto, íntegramente en el volumen de tokens. Las trazas de razonamiento se facturan a la tarifa de output, el doble de la de input, así que una respuesta corta puede costar varias veces su longitud visible una vez contada la cadena. Elígelo cuando acertar en problemas de varios pasos importe más que una factura previsible, y mide los recuentos reales de output en lugar de la tabla de precios, que mostrará cuatro filas idénticas.
Condiciones de facturación: Standard short-context API price. At 200K input tokens or more, xAI applies its published long-context rates to all tokens in the request.
- Ventana de contexto
- 1.000.000 tokens
- Corte de conocimiento
- —
- Última verificación del precio
- Primera observación
Las descripciones, capacidades y tarifas proceden de la fuente enlazada. Los precios oficiales tienen prioridad y los complementos de OpenRouter se indican.