Modellübersicht
Dreimal mehr pro Token zu zahlen bringt auf dem Papier weder zusätzlichen Kontext noch zusätzliche Fähigkeiten: deepseek-v4-pro gibt dasselbe Fenster von 1M Tokens und dieselbe Unterstützung für Reasoning, Tool-Calls, strukturierte Ausgabe und Fill-in-the-Middle an wie die günstigere Stufe, zu $1.32 pro Million Input-Tokens und $3.96 für Output. Ein Anhaltspunkt hilft, den Abstand einzuordnen — $1.32 verlangt Flash auch für die Erzeugung einer Million Tokens, das Lesen eines langen Dokuments kostet hier also so viel wie dort das Schreiben. Gecachter Input fällt auf $0.044, dreißigmal unter den Cache-Miss-Tarif, weshalb präfixlastige Agentenschleifen den Aufpreis besser auffangen als einmalige Aufrufe. Das sind Spitzenpreise; jeder davon halbiert sich außerhalb der Fenster 01:00-04:00 und 06:00-10:00 UTC.
Abrechnungsbedingungen: Standard peak price. Cache-miss input is shown as Input; cache-hit input is shown as Cached input. DeepSeek halves every rate off-peak.
- Kontextfenster
- 1.000.000 tokens
- Wissensstand
- —
- Preis zuletzt geprüft
- Erstmals beobachtet
Beschreibungen, Fähigkeiten und Tarife stammen aus der verlinkten Quelle. Offizielle Preise haben Vorrang; OpenRouter-Ergänzungen sind gekennzeichnet.