ggml‑org publicó llama.cpp versión b11462 el 2026‑10‑07. La actualización limpia los búferes de atención basados en SYCL, una interfaz de bajo nivel para cómputo gráfico. También incluye binarios precompilados para macOS (Apple Silicon e Intel), iOS y varias versiones de Ubuntu, con compilaciones para CPU, Vulkan y CUDA 12.8. Los binarios se pueden descargar desde la página de lanzamientos de GitHub.
Por qué importa
Ahora los desarrolladores pueden ejecutar llama.cpp localmente en más plataformas sin compilarlo desde el código fuente, lo que agiliza la experimentación.