ggml-org-teamet har släppt llama.cpp version b11471. Uppdateringen lägger till en ny uppsättning med 30090 plamo fim-token i modellens ordförråd. Den innehåller också färdigbyggda binärer för macOS med Apple Silicon, macOS med Intel, iOS och flera Linux-varianter (CPU, Vulkan, CUDA 12.8). Användare kan ladda ner rätt paket från versionssidan på GitHub.
Varför det spelar roll
Utvecklare kan nu köra llama.cpp lokalt på fler enheter utan att bygga från källkod, vilket sparar tid och förenklar testningen.