Présentation du modèle
Deux grilles tarifaires s'appliquent à un même modèle, et c'est ce qui sépare le palier Pro des échelons Flash. Jusqu'à 200K tokens, il facture $2 par million en input, $0.20 en cache et $12 en output — un tiers de plus que Flash sur chaque ligne, et 6.7 fois l'input de Lite pour 4.8 fois son output. Au-delà de 200K, Google publie $4 en input, $0.40 en cache et $18 en output, doublant le tarif de prompt et ajoutant la moitié à celui de génération pour la requête. Les longues exécutions d'agent franchissent donc une marche que les échelons moins chers ne rencontrent jamais. Comme gemini-3-1-pro-preview annonce le même raisonnement, les mêmes outils, la même entrée multimodale et le même cache de contexte que les autres, le surcoût achète le palier lui-même, et l'étiquette preview est l'autre élément à peser.
Conditions de facturation : Standard paid price for prompts up to 200K tokens. Above 200K, Google publishes $4 input, $0.40 cached input, and $18 output per million tokens.
- Fenêtre de contexte
- 0 tokens
- Fin des connaissances
- —
- Dernière vérification du tarif
- Première observation
Les descriptions, capacités et tarifs proviennent de la source liée. Les prix officiels sont prioritaires ; les compléments OpenRouter sont signalés.