ओपन-सोर्स llama.cpp लाइब्रेरी का संस्करण b11523, Oct 9, 2026 को जारी हुआ। इस अपडेट में उस क्रैश को ठीक किया गया है, जो WebGPU पर DUP ऑपरेशन चलाने की कोशिश के दौरान होता था। पहले DUP, CPU पर चलता था, जबकि बाकी काम WebGPU पर होता था। इससे बफ़र में गड़बड़ी होती और प्रोग्राम क्रैश हो जाता। अब DUP भी CPY (कॉपी) और CONT ऑपरेशन की तरह उसी कोड पाथ पर चलता है, इसलिए वह WebGPU पर ही रहता है।
यह क्यों मायने रखता है
WebGPU यूज़र अब llama.cpp मॉडल को मिक्स्ड बैच के साथ चला सकते हैं और प्रोग्राम क्रैश नहीं होगा।