Présentation du modèle
Plusieurs passes coordonnées tournent ici derrière un seul endpoint, et la grille tarifaire n'en laisse rien paraître : $1.25 par million de tokens en input, $0.20 en cache et $2.50 en output sur 1,000,000 de tokens de contexte, exactement comme les deux builds 4.20 mono-modèle et grok-4-3. La multiplication se produit dans la consommation, pas dans le prix unitaire. Chaque passe interne relit son contexte et émet ses propres tokens : une seule requête peut donc facturer un multiple de ce que la variante non-reasoning, au tarif identique, coûterait pour la même question. Deux leviers comptent en conséquence : le tarif en cache de $0.20, un sixième du prix hors cache, qui paie quand chaque passe rejoue le même préfixe, et le seuil de 200,000 tokens au-delà duquel les tarifs long contexte de xAI s'appliquent à toute la requête.
Conditions de facturation : Standard short-context API price. At 200K input tokens or more, xAI applies its published long-context rates to all tokens in the request.
- Fenêtre de contexte
- 1 000 000 tokens
- Fin des connaissances
- —
- Dernière vérification du tarif
- Première observation
Les descriptions, capacités et tarifs proviennent de la source liée. Les prix officiels sont prioritaires ; les compléments OpenRouter sont signalés.