Visão geral do modelo
A deliberação antes de responder é a única coisa que distingue este build, porque o contador não se mexe: $1.25 por milhão de tokens de input, $0.20 em cache e $2.50 de output são idênticos aos do seu gémeo non-reasoning, aos do build multi-agent e aos do grok-4-3, todos na mesma janela de 1,000,000 de tokens. A diferença de custo vive, portanto, inteiramente no volume de tokens. Os rastos de raciocínio são faturados à tarifa de output, o dobro da de input, pelo que uma resposta curta pode custar várias vezes o seu comprimento visível assim que a cadeia é contada. Escolha-o quando a correção em problemas de vários passos importar mais do que uma fatura previsível, e meça as contagens reais de output em vez da tabela de preços, que mostrará quatro linhas idênticas.
Condições de faturação: Standard short-context API price. At 200K input tokens or more, xAI applies its published long-context rates to all tokens in the request.
- Janela de contexto
- 1.000.000 tokens
- Limite de conhecimento
- —
- Última verificação do preço
- Primeira observação
As descrições, capacidades e tarifas vêm da fonte associada. Os preços oficiais têm prioridade e os complementos OpenRouter são assinalados.