🔎
Más
Especiales
Filtros
IA hace 2 h

Actualización v0.32.6

Actualización v0.32.6

Se ha lanzado una actualización para el modelo de lenguaje ollama, con la versión v0.32.6. Esta versión incluye mejoras en el rendimiento y la compatibilidad con diferentes plataformas.

Entre los cambios destacados se encuentra la mejora en la velocidad del motor MLX en GPUs de Apple, gracias a la utilización del cabezal MTP para decodificación especulativa. Además, se ha actualizado el formato de transmisión de completions para que coincida con el formato de OpenAI, lo que incluye la inclusión de la función de rol solo en el primer trozo, la razón de finalización en su propio trozo y el uso en un trozo separado con opciones de transmisión.

“Entre los cambios destacados se encuentra la mejora en la velocidad del motor MLX en GPUs de Apple, gracias a la utilización del cabezal MTP para decodificación especulativa”

La versión v0.32.6 también incluye correcciones para problemas de interfaz de usuario, como la renderización de texto con delimitadores de tuberías y la aceptación de completados de archivos con la tecla Enter. Sin embargo, se ha eliminado temporalmente la generación de imágenes experimental, por lo que los usuarios deben seguir utilizando la versión 0.32.5 para esta función.

Los desarrolladores han actualizado los motores MLX y llama.cpp, y se han realizado cambios en la compatibilidad con modelos en la nube. La versión v0.32.6 está disponible para su descarga, y los usuarios pueden ver el registro de cambios completo para obtener más información sobre las mejoras y correcciones incluidas en esta actualización.

El modelo de lenguaje ollama es una herramienta de inteligencia artificial que permite la generación de texto y la conversación con un asistente virtual. La versión v0.32.6 es una actualización importante que busca mejorar el rendimiento y la compatibilidad de la herramienta, y es esperada por los desarrolladores y usuarios que trabajan con esta tecnología.

Etiquetas #qwen#openai#gpu

Más sobre IA