Het ggml-org-team heeft llama.cpp versie b11471 uitgebracht. Deze versie voegt 30090 plamo fim-tokens toe aan de woordenschat van het model. Ook zijn er kant-en-klare binaries beschikbaar voor macOS met Apple Silicon, macOS met Intel, iOS en verschillende Linux-configuraties (CPU, Vulkan, CUDA 12.8). Gebruikers kunnen het juiste pakket downloaden via de GitHub-releasepagina.
Waarom het ertoe doet
Ontwikkelaars kunnen llama.cpp nu op meer apparaten lokaal gebruiken zonder het programma zelf te compileren. Dat bespaart tijd en maakt testen eenvoudiger.