ggml-org publicó la versión b11539 de llama.cpp, un entorno ligero para ejecutar LLM en distintos dispositivos. Ya están disponibles nuevos archivos binarios para macOS con Apple Silicon, macOS con Intel, iOS XCFramework y varias compilaciones para Ubuntu que cubren CPU, Vulkan y CUDA 12.8. Los enlaces de descarga están en la página de la versión en GitHub.
Por qué importa
Ahora los desarrolladores pueden ejecutar llama.cpp localmente en más tipos de hardware sin tener que compilarlo por su cuenta.