ggml‑org/llama.cpp प्रोजेक्ट ने 2026‑10‑09 को b11516 संस्करण जारी किया। इस अपडेट में Hexagon NPU पाथ का एक बग ठीक किया गया है, जिसमें DMA रिंग ओवरफ़्लो होने से पुराना डेटा और NaN/inf नतीजे मिल सकते थे। अब रिंग भर जाने पर कोड सबसे पुराना डिस्क्रिप्टर हटा देता है और बाद में क्यू को फ़्लश करता है। बड़े patch‑embed ऑपरेशनों वाले टेस्ट अब Hexagon हार्डवेयर पर पास होते हैं।
यह क्यों मायने रखता है
Qualcomm Hexagon डिवाइसों पर llama.cpp इस्तेमाल करने वाले डेवलपरों को ग़लत NaN के बजाय मॉडल के सही आउटपुट मिलेंगे।