ggml‑org hat Version b11539 von llama.cpp veröffentlicht, einer schlanken Laufzeitumgebung für LLMs, die auf vielen Geräten läuft. Neue Binärarchive gibt es für macOS mit Apple Silicon, macOS mit Intel-Prozessoren, das iOS-XCFramework sowie verschiedene Ubuntu-Versionen für CPU, Vulkan und CUDA 12.8. Die Download-Links stehen auf der GitHub-Release-Seite.
Warum es wichtig ist
Entwickler können llama.cpp damit auf mehr Hardware lokal ausführen, ohne das Programm selbst kompilieren zu müssen.