ggml-org-teamet släppte llama.cpp version b11528 den 2026-10-09. Uppdateringen gör att biblioteket kan hantera vyer av tensorer som allokerats på värden som vanliga noder. Därmed försvinner ett tidigare assert-fel som uppstod med tensoralternativet –split-mode. Uppdateringen återinför också stöd för SM-tensorer i K2 Horizon-acceleratorn. Ändringen ingår i den officiella GitHub-versionen och gäller alla plattformar som listas, från macOS till Windows och Linux.
Varför det spelar roll
Utvecklare kan nu köra llama.cpp med uppdelad KV-cache på fler typer av hårdvara utan krascher, vilket ger fler möjliga konfigurationer för lokal inferens med stora språkmodeller.