Het ggml-org-team publiceerde llama.cpp-versie b11270 op 30 september 2026. De update past een GPU-bewerking voor AMD’s HIP-platform aan en vervangt een tragere instructie voor byte-aftrekking door een snellere. Ook bevat de release nieuwe binaire pakketten voor macOS (Apple Silicon en Intel), iOS en verschillende Ubuntu-versies, waaronder GPU-versies met Vulkan-ondersteuning.
Waarom het ertoe doet
De GPU-aanpassing kan inferentie op AMD-hardware versnellen. De kant-en-klare binaries maken het voor ontwikkelaars bovendien eenvoudiger om llama.cpp op meer platforms uit te proberen.