Das ggml-org-Team hat am 1. Okt. 2026 Version b11322 von llama.cpp veröffentlicht. Das Update enthält vorkompilierte Binärdateien für macOS auf Apple Silicon und Intel, iOS sowie mehrere Ubuntu-Varianten (CPU, Vulkan, CUDA). Außerdem wurde eine Race Condition in der Komponente hex-workqueue behoben. Die Binärdateien stehen auf der GitHub-Release-Seite direkt zum Download bereit.
Warum es wichtig ist
Entwickler können llama.cpp jetzt auf mehr Plattformen lokal ausführen, ohne den Quellcode selbst kompilieren zu müssen. Das beschleunigt Tests und die Bereitstellung.