ggml-org publicó la versión b11555 de llama.cpp. La actualización corrige un error por el que los procesadores AVX2 no utilizaban el conjunto de instrucciones F16C, aunque estuviera disponible. La versión también incluye nuevos paquetes binarios para macOS con Apple Silicon, macOS con Intel, iOS y varias configuraciones de Ubuntu, entre ellas con compatibilidad con Vulkan y CUDA 12.8.
Por qué importa
Quienes ejecuten modelos Llama en procesadores compatibles podrán obtener inferencias más rápidas sin aplicar parches manualmente.