La biblioteca de código abierto llama.cpp publicó la versión b11511 el 8 de octubre de 2026. Esta corrige un error de lectura fuera de límites en CUDA dentro de la implementación MMQ. La actualización también incorpora binarios listos para usar en macOS (Apple Silicon e Intel), iOS y Ubuntu para x64, arm64 y s390x, además de versiones compiladas para Vulkan y CUDA 12.8.
Por qué importa
Los desarrolladores ahora pueden ejecutar llama.cpp en más hardware sin que se produzcan fallos, en especial quienes usan GPU de NVIDIA.