Resumen del modelo
El trabajo multimodal y multilingüe empieza aquí: 0.15 por millón de tokens de input y 0.6 de output convierten a mistral-small-latest en el modelo Mistral más barato que acepta imágenes. Frente a mistral-large-latest, la diferencia es de 3.3 veces en input (0.5) y de 2.5 veces en output (1.5) para un par de capacidades declaradas idéntico, multimodal y multilingüe, y ese es el argumento para empezar en este nivel y subir solo cuando la calidad lo obligue. La comparación con ministral-8b-latest es más nítida: los mismos 0.15 para enviar, pero 0.6 frente a 0.15 para recibir, cuatro veces más, de modo que es la longitud de la respuesta, y no el tamaño del prompt, lo que decide entre ambos.
Condiciones de facturación: Standard API price. Mistral publishes a 90% discount for cached input; cache-write prices are not published separately.
- Ventana de contexto
- 0 tokens
- Corte de conocimiento
- —
- Última verificación del precio
- Primera observación
Las descripciones, capacidades y tarifas proceden de la fuente enlazada. Los precios oficiales tienen prioridad y los complementos de OpenRouter se indican.