Visão geral do modelo
Aqui correm várias passagens coordenadas por trás de um único endpoint, e a tabela de preços não o deixa adivinhar: $1.25 por milhão de tokens de input, $0.20 em cache e $2.50 de output sobre 1,000,000 de tokens de contexto, exatamente como os dois builds 4.20 de modelo único e o grok-4-3. A multiplicação acontece no consumo, não no preço unitário. Cada passagem interna volta a ler o seu contexto e emite os seus próprios tokens, pelo que um único pedido pode faturar um múltiplo do que a variante non-reasoning, ao mesmo preço, cobraria pela mesma pergunta. Por isso contam duas alavancas: a tarifa em cache de $0.20, um sexto do preço sem cache, que compensa quando cada passagem repete o mesmo prefixo, e o limiar de 200,000 tokens acima do qual as tarifas de contexto longo da xAI se aplicam a todo o pedido.
Condições de faturação: Standard short-context API price. At 200K input tokens or more, xAI applies its published long-context rates to all tokens in the request.
- Janela de contexto
- 1.000.000 tokens
- Limite de conhecimento
- —
- Última verificação do preço
- Primeira observação
As descrições, capacidades e tarifas vêm da fonte associada. Os preços oficiais têm prioridade e os complementos OpenRouter são assinalados.