Resumen del modelo
Aquí corren varias pasadas coordinadas detrás de un solo endpoint, y la tabla de precios no lo insinúa: $1.25 por millón de tokens de input, $0.20 en cache y $2.50 de output sobre 1,000,000 de tokens de contexto, exactamente igual que los dos builds 4.20 de modelo único y que grok-4-3. La multiplicación ocurre en el consumo, no en el precio unitario. Cada pasada interna vuelve a leer su contexto y emite sus propios tokens, así que una sola petición puede facturar un múltiplo de lo que la variante non-reasoning, con precio idéntico, cobraría por la misma pregunta. Por eso importan dos palancas: la tarifa en cache de $0.20, un sexto del precio sin acierto, que compensa cuando cada pasada repite el mismo prefijo, y el umbral de 200,000 tokens por encima del cual las tarifas de contexto largo de xAI se aplican a toda la petición.
Condiciones de facturación: Standard short-context API price. At 200K input tokens or more, xAI applies its published long-context rates to all tokens in the request.
- Ventana de contexto
- 1.000.000 tokens
- Corte de conocimiento
- —
- Última verificación del precio
- Primera observación
Las descripciones, capacidades y tarifas proceden de la fuente enlazada. Los precios oficiales tienen prioridad y los complementos de OpenRouter se indican.