Présentation du modèle
L'échelon intermédiaire de la gamme Google facture $1.50 par million de tokens en input et $9 par million en output — exactement cinq fois le tarif d'input du palier Lite et 3.6 fois son tarif d'output, mais un quart en dessous des $2 en input et $12 en output de la preview Pro. Cette asymétrie est l'argument de gemini-3-5-flash : passer de Lite à ce palier multiplie par cinq la facture de prompt mais par moins de quatre celle de génération, alors que passer à Pro n'ajoute qu'un tiers sur les deux compteurs. Les trois échelons déclarent le même raisonnement, le même appel d'outils, la même entrée multimodale et le même cache de contexte : rien à gagner ni à perdre côté fonctionnalités. L'input mis en cache coûte $0.15, un dixième du tarif standard, et Google facture le stockage du cache à part, par token-heure.
Conditions de facturation : Standard paid text price. Google bills cache storage separately per token-hour; that storage charge is not represented as a cache-write token rate.
- Fenêtre de contexte
- 0 tokens
- Fin des connaissances
- —
- Dernière vérification du tarif
- Première observation
Les descriptions, capacités et tarifs proviennent de la source liée. Les prix officiels sont prioritaires ; les compléments OpenRouter sont signalés.