Présentation du modèle
La délibération avant de répondre est la seule chose qui distingue ce build, car le compteur ne bouge pas : $1.25 par million de tokens en input, $0.20 en cache et $2.50 en output, identiques à son jumeau non-reasoning, au build multi-agent et à grok-4-3, tous sur la même fenêtre de 1,000,000 de tokens. L'écart de coût tient donc entièrement au volume de tokens. Les traces de raisonnement sont facturées au tarif output, deux fois le tarif input : une réponse courte peut donc coûter plusieurs fois sa longueur visible une fois la chaîne comptée. À choisir quand la justesse sur des problèmes en plusieurs étapes compte plus qu'une facture prévisible, et à mesurer sur les volumes d'output réels plutôt que sur la grille tarifaire, qui affichera quatre lignes identiques.
Conditions de facturation : Standard short-context API price. At 200K input tokens or more, xAI applies its published long-context rates to all tokens in the request.
- Fenêtre de contexte
- 1 000 000 tokens
- Fin des connaissances
- —
- Dernière vérification du tarif
- Première observation
Les descriptions, capacités et tarifs proviennent de la source liée. Les prix officiels sont prioritaires ; les compléments OpenRouter sont signalés.