Oossa

llama.cpp में DUP ऑपरेशन के लिए WebGPU सपोर्ट

संस्करण b11523 का अपडेट DUP ऑपरेशन को WebGPU पर चलाता है, जिससे मिक्स्ड-बैच मॉडल चलाते समय क्रैश नहीं होता।

संक्षिप्तलेखक: Oossa द्वारा प्रकाशित: 1 मिनट पढ़ना

ओपन-सोर्स llama.cpp लाइब्रेरी का संस्करण b11523, Oct 9, 2026 को जारी हुआ। इस अपडेट में उस क्रैश को ठीक किया गया है, जो WebGPU पर DUP ऑपरेशन चलाने की कोशिश के दौरान होता था। पहले DUP, CPU पर चलता था, जबकि बाकी काम WebGPU पर होता था। इससे बफ़र में गड़बड़ी होती और प्रोग्राम क्रैश हो जाता। अब DUP भी CPY (कॉपी) और CONT ऑपरेशन की तरह उसी कोड पाथ पर चलता है, इसलिए वह WebGPU पर ही रहता है।

यह क्यों मायने रखता है

WebGPU यूज़र अब llama.cpp मॉडल को मिक्स्ड बैच के साथ चला सकते हैं और प्रोग्राम क्रैश नहीं होगा।

क्या यह लेख उपयोगी था?
साझा करें

यह भी पढ़ें

Oossa · न्यूज़लेटर

AI का हफ़्ता, आसान भाषा में

हर सोमवार: जानने लायक खबरें, सरल भाषा में। मुफ़्त, कोई स्पैम नहीं।