Oossa

llama.cpp v b11499 में CUDA सुधार, नए बाइनरी

ओपन-सोर्स LLM रनटाइम llama.cpp का संस्करण b11499 8 Oct 2026 को जारी हुआ। इसमें non-contiguous roll ऑपरेशंस के लिए CUDA सुधार और macOS, iOS व Linux के नए प्री-बिल्ट बाइनरी शामिल हैं।

संक्षिप्तलेखक: Oossa द्वारा प्रकाशित: 1 मिनट पढ़ना

ggml-org टीम ने 8 Oct 2026 को llama.cpp का रिलीज़ b11499 जारी किया। इस अपडेट में CUDA बैकएंड के roll ऑपरेशन के लिए byte strides का इस्तेमाल किया गया है, जिससे GPU non-contiguous डेटा को सही ढंग से संभाल सकता है। रिलीज़ में Apple Silicon, Intel macOS, iOS और Ubuntu के कई बिल्ड (CPU, Vulkan और CUDA 12) के नए बाइनरी भी शामिल हैं। सभी फ़ाइलें GitHub के रिलीज़ पेज से डाउनलोड की जा सकती हैं।

यह क्यों मायने रखता है

डेवलपर बिना त्रुटियों के ज़्यादा GPU सेटअप पर llama.cpp चला सकते हैं, जिससे डेस्कटॉप और सर्वर पर स्थानीय LLM का इस्तेमाल बढ़ेगा।

क्या यह लेख उपयोगी था?
साझा करें

यह भी पढ़ें

Oossa · न्यूज़लेटर

AI का हफ़्ता, आसान भाषा में

हर सोमवार: जानने लायक खबरें, सरल भाषा में। मुफ़्त, कोई स्पैम नहीं।