Présentation du modèle
Dans le catalogue Mistral, mistral-medium-latest est le seul modèle à réunir à la fois des capacités de reasoning, de coding, agentiques et multimodales, et le prix s'en ressent : 1.5 USD par million de tokens en input contre 7.5 en output, une asymétrie de cinq contre un qu'aucun autre modèle de cette gamme n'applique. Face à mistral-large-latest à 0.5 en input et 1.5 en output, vous payez trois fois plus pour envoyer des tokens et cinq fois plus pour les recevoir : le palier n'est donc rentable que sur les tâches où le supplément de raisonnement change la réponse. L'input mis en cache tombe à 0.15, exactement ce que le palier small facture au tarif plein, ce qui rend les prompts longs et stables bien moins pénalisants que les générations longues.
Conditions de facturation : Standard API price. Mistral publishes a 90% discount for cached input; cache-write prices are not published separately.
- Fenêtre de contexte
- 0 tokens
- Fin des connaissances
- —
- Dernière vérification du tarif
- Première observation
Les descriptions, capacités et tarifs proviennent de la source liée. Les prix officiels sont prioritaires ; les compléments OpenRouter sont signalés.