Actualización de Ollama a v0.32.4
La versión 0.32.4 de Ollama ha sido lanzada. Esta actualización incluye mejoras en el soporte para Apple GPUs a través del motor MLX y la cuantización de las salidas de los modelos.
Entre los cambios destacados se encuentra el soporte para Laguna en Apple GPUs, lo que permite una mejor compatibilidad con los dispositivos de Apple. Además, se ha implementado la cuantización de las salidas de los modelos en el momento de la creación de borradores de decodificación especulativa. Esto puede mejorar la eficiencia y la precisión de los modelos.
“Entre los cambios destacados se encuentra el soporte para Laguna en Apple GPUs, lo que permite una mejor compatibilidad con los dispositivos de Apple”
La actualización también incluye correcciones para el decodificador Qwen3 MoE, que ahora es compatible con expertos cuantizados de manera diferente. Además, se ha optimizado la proyección de puertas y la compresión de datos, lo que puede resultar en un rendimiento más rápido en dispositivos como el M5 Max, con mejoras que van del 4 al 9 por ciento.
La comunidad de desarrolladores ha recibido esta actualización con entusiasmo, con varios contribuyentes expresando su aprobación y gratitud por los esfuerzos del equipo de desarrollo. La versión 0.32.4 de Ollama está disponible para su descarga y uso, y se espera que continúe mejorando la capacidad de los modelos de lenguaje para procesar y generar texto de manera efectiva.
Ollama es un proyecto de código abierto que busca avanzar en el campo de la inteligencia artificial y el procesamiento del lenguaje natural. Con esta actualización, el equipo de desarrollo busca mejorar la compatibilidad y el rendimiento de los modelos, lo que puede tener un impacto significativo en la comunidad de desarrolladores y usuarios de tecnologías de IA.