El equipo de ggml-org publicó la versión b11501 de llama.cpp el 8 de octubre de 2026. La actualización incorpora optimizaciones para la transformada rápida de Walsh-Hadamard (FWHT) en SYCL (una API de computación multiplataforma), que pueden acelerar ciertas operaciones matriciales. También incluye binarios listos para usar en macOS con Apple Silicon, macOS con Intel, iOS y versiones de Ubuntu con compatibilidad con CPU, Vulkan y CUDA 12.8.
Por qué importa
Los desarrolladores ahora pueden ejecutar modelos Llama más rápido en GPU compatibles con SYCL y evitar compilar la biblioteca por su cuenta.