Visão geral do modelo
O trabalho multimodal e multilingue começa aqui: 0.15 por milhão de tokens de input e 0.6 no output fazem do mistral-small-latest o modelo Mistral mais barato que aceita imagens. Face ao mistral-large-latest, a diferença é de 3.3 vezes no input (0.5) e de 2.5 vezes no output (1.5) para um par de capacidades declaradas idêntico, multimodal e multilingue, e é esse o argumento para começar neste escalão e subir apenas quando a qualidade o obrigar. A comparação com o ministral-8b-latest é mais nítida: os mesmos 0.15 para enviar, mas 0.6 contra 0.15 para receber, quatro vezes mais, pelo que é o comprimento da resposta, e não o tamanho do prompt, que decide entre os dois.
Condições de faturação: Standard API price. Mistral publishes a 90% discount for cached input; cache-write prices are not published separately.
- Janela de contexto
- 0 tokens
- Limite de conhecimento
- —
- Última verificação do preço
- Primeira observação
As descrições, capacidades e tarifas vêm da fonte associada. Os preços oficiais têm prioridade e os complementos OpenRouter são assinalados.