Panoramica del modello
Qui girano più passate coordinate dietro un solo endpoint, e il listino non lo lascia intuire: $1.25 per milione di token di input, $0.20 in cache e $2.50 di output su 1,000,000 di token di contesto, esattamente come i due build 4.20 a modello singolo e grok-4-3. La moltiplicazione avviene nel consumo, non nel prezzo unitario. Ogni passata interna rilegge il proprio contesto ed emette i propri token, quindi una singola richiesta può fatturare un multiplo di quanto la variante non-reasoning, allo stesso prezzo, addebiterebbe per la stessa domanda. Contano perciò due leve: la tariffa in cache di $0.20, un sesto del prezzo senza cache, che ripaga quando ogni passata ripete lo stesso prefisso, e la soglia di 200,000 token oltre la quale le tariffe long-context di xAI si applicano all'intera richiesta.
Condizioni di fatturazione: Standard short-context API price. At 200K input tokens or more, xAI applies its published long-context rates to all tokens in the request.
- Finestra di contesto
- 1.000.000 tokens
- Limite delle conoscenze
- —
- Ultima verifica del prezzo
- Prima osservazione
Descrizioni, funzionalità e tariffe provengono dalla fonte collegata. I prezzi ufficiali hanno priorità e le integrazioni OpenRouter sono indicate.