L’équipe ggml-org a publié la version b11322 de llama.cpp le 1er octobre 2026. La mise à jour comprend des binaires précompilés pour macOS sur Apple Silicon, macOS sur Intel, iOS et plusieurs versions d’Ubuntu (CPU, Vulkan, CUDA). Elle inclut également un correctif de condition de concurrence dans le composant hex-workqueue. Les binaires sont disponibles en téléchargement direct sur la page de la version sur GitHub.
Pourquoi c'est important
Les développeurs peuvent désormais exécuter llama.cpp localement sur davantage de plateformes sans le compiler à partir des sources, ce qui accélère les tests et le déploiement.