Présentation du modèle
Le travail multimodal et multilingue commence ici : 0.15 par million de tokens en input et 0.6 en output font de mistral-small-latest le modèle Mistral le moins cher qui accepte les images. Face à mistral-large-latest, l'écart est de 3.3 fois en input (0.5) et de 2.5 fois en output (1.5) pour un couple de capacités déclarées identique, multimodal et multilingue : c'est l'argument pour démarrer à ce palier et ne monter que lorsque la qualité l'impose. La comparaison avec ministral-8b-latest est plus tranchée : les mêmes 0.15 pour envoyer, mais 0.6 contre 0.15 pour recevoir, quatre fois plus, si bien que c'est la longueur des réponses, et non la taille des prompts, qui départage les deux.
Conditions de facturation : Standard API price. Mistral publishes a 90% discount for cached input; cache-write prices are not published separately.
- Fenêtre de contexte
- 0 tokens
- Fin des connaissances
- —
- Dernière vérification du tarif
- Première observation
Les descriptions, capacités et tarifs proviennent de la source liée. Les prix officiels sont prioritaires ; les compléments OpenRouter sont signalés.