ggml‑org heeft versie b11539 van llama.cpp uitgebracht, de lichte LLM-runner die op allerlei apparaten werkt. Er zijn nieuwe binaire archieven beschikbaar voor macOS met Apple Silicon, macOS met Intel, het iOS XCFramework en verschillende Ubuntu-builds voor CPU, Vulkan en CUDA 12.8. De downloadlinks staan op de GitHub-releasepagina.
Waarom het ertoe doet
Ontwikkelaars kunnen llama.cpp nu lokaal op meer hardware gebruiken zonder het zelf te hoeven bouwen.