El equipo de ggml-org publicó llama.cpp versión b11461 el 2026-10-07. La actualización corrige la lectura lenta de puntos de control al usar Vulkan en GPU AMD integrada. También ofrece nuevos paquetes binarios para Apple Silicon, Mac con Intel, iOS y varias versiones de Linux (CPU, Vulkan, CUDA 12.8). Los usuarios pueden descargar el archivo correspondiente desde la página de lanzamientos de GitHub.
Por qué importa
Los usuarios de portátiles AMD ahora pueden ejecutar modelos LLaMA más rápido, sin la ralentización anterior.