Projektet ggml‑org/llama.cpp släppte version b11516 den 2026‑10‑09. Uppdateringen åtgärdar ett fel i Hexagon NPU-sökvägen där DMA-ringen kunde svämma över och orsaka inaktuella data samt NaN/inf-resultat. Koden tar nu bort den äldsta beskrivaren när ringen är full och tömmer kön senare. Testfall med stora patch-embed-operationer går nu igenom på Hexagon-hårdvara.
Varför det spelar roll
Utvecklare som använder llama.cpp på Qualcomm Hexagon-enheter får korrekta modellresultat i stället för felaktiga NaN-värden.