La última versión de Ollama, v0.32.14, trae varias mejoras prácticas para desarrolladores que ejecutan modelos de lenguaje locales. La nueva transcodificación automática WebP simplifica el manejo de entradas de imágenes en modelos multimodales, reduciendo un paso común de preprocesamiento. Además, la compatibilidad mejorada con mensajes de sistema Qwen garantiza un seguimiento más fiable de instrucciones para implementaciones basadas en Qwen. La actualización también incluye backends actualizados de llama.cpp y MLX, que pueden ofrecer ganancias de rendimiento en sistemas CPU y Apple Silicon. Para equipos que integran Ollama en sus pipelines, estos cambios reducen fricciones y mejoran la consistencia entre diferentes arquitecturas de modelos. Aunque no es un salto de versión mayor, este lanzamiento refleja la evolución constante de la plataforma hacia una inferencia local más robusta.
Ollama v0.32.14 añade transcodificación automática WebP y compatibilidad con mensajes de sistema Qwen, además de actualizaciones de llama.cpp y MLX para mejorar los flujos de trabajo locales de LLM.