Oossa

llama.cpp får stöd för tensorvyer på värden och K2 Horizon

Versionen från 9 oktober 2026 åtgärdar en krasch vid uppdelning av KV-cache och återinför stöd för K2 Horizon-hårdvara.

NotisAv Publicerad av Oossa: 1 min läsning

ggml-org-teamet släppte llama.cpp version b11528 den 2026-10-09. Uppdateringen gör att biblioteket kan hantera vyer av tensorer som allokerats på värden som vanliga noder. Därmed försvinner ett tidigare assert-fel som uppstod med tensoralternativet –split-mode. Uppdateringen återinför också stöd för SM-tensorer i K2 Horizon-acceleratorn. Ändringen ingår i den officiella GitHub-versionen och gäller alla plattformar som listas, från macOS till Windows och Linux.

Varför det spelar roll

Utvecklare kan nu köra llama.cpp med uppdelad KV-cache på fler typer av hårdvara utan krascher, vilket ger fler möjliga konfigurationer för lokal inferens med stora språkmodeller.

Var den här artikeln användbar?
Dela

Läs vidare

Oossa · Nyhetsbrev

Veckans AI, förklarad

Varje måndag: nyheterna som är värda att känna till, på enkel svenska. Gratis, ingen spam.