El equipo de ggml-org publicó llama.cpp versión b11270 el 30 de septiembre de 2026. La actualización modifica una operación de GPU usada por la plataforma HIP de AMD: sustituye una instrucción de resta de bytes más lenta por otra más rápida. El lanzamiento también incluye nuevos paquetes binarios para macOS (Apple Silicon e Intel), iOS y varias versiones de Ubuntu, incluidas versiones con GPU y Vulkan.
Por qué importa
La mejora en GPU puede acelerar la inferencia en hardware de AMD, y los binarios listos para usar facilitan que los desarrolladores prueben llama.cpp en más plataformas.