Das Team von ggml-org hat llama.cpp in Version b11471 veröffentlicht. Die Modellvokabeln werden um 30090 neue plamo-fim-Tokens ergänzt. Außerdem enthält die Veröffentlichung direkt ausführbare Binärdateien für macOS mit Apple Silicon, macOS mit Intel, iOS und mehrere Linux-Varianten (CPU, Vulkan, CUDA 12.8). Das passende Paket können Nutzer auf der GitHub-Seite zur Veröffentlichung herunterladen.
Warum es wichtig ist
Entwickler können llama.cpp nun auf mehr Geräten lokal ausführen, ohne den Quellcode selbst kompilieren zu müssen. Das spart Zeit und vereinfacht Tests.