Panoramica del modello
La deliberazione prima di rispondere è l'unica cosa che distingue questo build, perché il contatore non si muove: $1.25 per milione di token di input, $0.20 in cache e $2.50 di output sono identici a quelli del gemello non-reasoning, del build multi-agent e di grok-4-3, tutti sulla stessa finestra da 1,000,000 di token. La differenza di costo sta quindi interamente nel volume di token. Le tracce di ragionamento sono fatturate alla tariffa di output, il doppio di quella di input, per cui una risposta breve può costare diverse volte la sua lunghezza visibile una volta contata la catena. Sceglilo quando la correttezza su problemi a più passaggi conta più di una fattura prevedibile, e misura i conteggi reali di output invece del listino, che mostrerà quattro righe identiche.
Condizioni di fatturazione: Standard short-context API price. At 200K input tokens or more, xAI applies its published long-context rates to all tokens in the request.
- Finestra di contesto
- 1.000.000 tokens
- Limite delle conoscenze
- —
- Ultima verifica del prezzo
- Prima osservazione
Descrizioni, funzionalità e tariffe provengono dalla fonte collegata. I prezzi ufficiali hanno priorità e le integrazioni OpenRouter sono indicate.