Het team van ggml-org publiceerde op 8 okt. 2026 versie b11486 van llama.cpp. De update verbetert de nauwkeurigheid van de GELU-activatiefunctie, een klein wiskundig onderdeel dat in veel taalmodellen wordt gebruikt. Ook zijn er voorgebouwde binaries beschikbaar voor Apple Silicon, Intel-macs, iOS en verschillende Ubuntu-configuraties (CPU, Vulkan, CUDA). De binaries zijn rechtstreeks te downloaden vanaf de releasepagina.
Waarom het ertoe doet
Ontwikkelaars kunnen LLaMA-modellen op hun eigen apparaten sneller uitvoeren en nauwkeuriger berekeningen maken.