ggml‑org publicó llama.cpp versión b11466 el 7 de octubre de 2026. La actualización corrige la comprobación supports_op de flash_attn para pares de clave y valor superpuestos. También incorpora binarios listos para usar en macOS con Apple Silicon, macOS con Intel, iOS y varias versiones de Ubuntu (CPU, Vulkan y CUDA 12.8). Los archivos se pueden descargar desde la página de versiones de GitHub.
Por qué importa
Los desarrolladores pueden ejecutar la versión más reciente de llama.cpp en más plataformas sin tener que compilar el código fuente.