La dernière version d'Ollama, v0.32.14, apporte plusieurs améliorations pratiques pour les développeurs exécutant des modèles de langage locaux. Le nouveau transcodage WebP automatique simplifie le traitement des entrées d'images dans les modèles multimodaux, réduisant une étape de prétraitement courante. De plus, la compatibilité améliorée avec les messages système Qwen garantit un suivi plus fiable des instructions pour les déploiements basés sur Qwen. La mise à jour inclut également des backends llama.cpp et MLX rafraîchis, ce qui peut apporter des gains de performance sur les systèmes CPU et Apple Silicon. Pour les équipes intégrant Ollama dans leurs pipelines, ces changements réduisent les frictions et améliorent la cohérence entre différentes architectures de modèles. Bien qu'il ne s'agisse pas d'une mise à jour majeure, cette version reflète l'évolution constante de la plateforme vers une inférence locale plus robuste.
Ollama v0.32.14 ajoute le transcodage WebP automatique et la compatibilité des messages système Qwen, ainsi que des mises à jour llama.cpp et MLX pour améliorer les flux de travail LLM locaux.