Het ggml-org-team heeft op 2026-10-08 llama.cpp versie b11498 uitgebracht. De update verhelpt een probleem met een CUDA-kernel dat zich voordeed wanneer bepaalde tensorafmetingen de limieten van het GPU-raster overschreden. Ook bevat de release nieuwe vooraf gecompileerde binaries voor Apple Silicon, Intel-macs, iOS en verschillende Ubuntu-configuraties, waaronder CPU-, Vulkan- en CUDA 12.8-versies.
Waarom het ertoe doet
Ontwikkelaars kunnen llama.cpp nu op meer GPU-configuraties gebruiken zonder crashes en krijgen direct inzetbare binaries voor hun platform.