Présentation du modèle
Deux dollars par million de tokens en input et six par million en output font de grok-4-5 le seul Grok facturé au-dessus du reste de la gamme, et le surcoût n'achète pas de contexte : la fenêtre s'arrête à 500,000 tokens, la moitié de ce que grok-4-3 et chaque variante 4.20 lisent pour $1.25 en input et $2.50 en output. La prime est donc de 1.6x sur l'input et de 2.4x sur l'output pour une fenêtre plus courte et la seule étiquette de modèle phare, puisque le reasoning, les tool calls et l'output structuré sont déclarés sur les six entrées. Son rapport output/input est le plus raide de la gamme, à trois pour un : la longueur de génération dicte la facture. L'input mis en cache à $0.30 représente 15 pour cent du tarif hors cache, la remise de cache proportionnellement la plus forte que publie xAI.
Conditions de facturation : Standard short-context API price. At 200K input tokens or more, xAI applies its published long-context rates to all tokens in the request.
- Fenêtre de contexte
- 500 000 tokens
- Fin des connaissances
- —
- Dernière vérification du tarif
- Première observation
Les descriptions, capacités et tarifs proviennent de la source liée. Les prix officiels sont prioritaires ; les compléments OpenRouter sont signalés.