Modellübersicht
Die mittlere Stufe von Googles Reihe berechnet $1.50 pro Million Input-Tokens und $9 pro Million Output — genau das Fünffache des Input-Tarifs der Lite-Stufe und das 3.6-Fache ihres Output-Tarifs, aber ein Viertel unter den $2 Input und $12 Output der Pro-Preview. Diese Asymmetrie ist das Argument für gemini-3-5-flash: Der Schritt von Lite nach oben verfünffacht die Prompt-Rechnung, die Generierungsrechnung dagegen um weniger als das Vierfache, während der Schritt zu Pro auf beiden Zählern nur ein Drittel hinzufügt. Alle drei Stufen führen dasselbe Reasoning, Tool Calling, multimodale Eingabe und Context Caching, bei den Funktionen geht also weder etwas verloren noch hinzu. Gecachter Input kostet $0.15, ein Zehntel des Standardtarifs, und Google berechnet den Cache-Speicher separat pro Token-Stunde.
Abrechnungsbedingungen: Standard paid text price. Google bills cache storage separately per token-hour; that storage charge is not represented as a cache-write token rate.
- Kontextfenster
- 0 tokens
- Wissensstand
- —
- Preis zuletzt geprüft
- Erstmals beobachtet
Beschreibungen, Fähigkeiten und Tarife stammen aus der verlinkten Quelle. Offizielle Preise haben Vorrang; OpenRouter-Ergänzungen sind gekennzeichnet.