Visão geral do modelo
O degrau intermédio da gama da Google cobra $1.50 por milhão de tokens de input e $9 por milhão de output: exatamente cinco vezes a tarifa de input do nível Lite e 3.6 vezes a de output, mas um quarto abaixo dos $2 de input e $12 de output da preview Pro. É essa assimetria o argumento a favor do gemini-3-5-flash: subir a partir do Lite multiplica por cinco a fatura do prompt, mas a de geração por menos de quatro, ao passo que subir para o Pro acrescenta apenas um terço em ambos os contadores. Os três degraus declaram o mesmo reasoning, as mesmas chamadas a ferramentas, a mesma entrada multimodal e o mesmo context caching, por isso nada se ganha nem se perde em funcionalidades. O input em cache custa $0.15, um décimo da tarifa padrão, e a Google fatura o armazenamento da cache à parte, por token-hora.
Condições de faturação: Standard paid text price. Google bills cache storage separately per token-hour; that storage charge is not represented as a cache-write token rate.
- Janela de contexto
- 0 tokens
- Limite de conhecimento
- —
- Última verificação do preço
- Primeira observação
As descrições, capacidades e tarifas vêm da fonte associada. Os preços oficiais têm prioridade e os complementos OpenRouter são assinalados.