ggml-org टीम ने 2026-10-09 को llama.cpp version b11528 जारी किया। इस अपडेट से लाइब्रेरी, host-allocated tensors के views को सामान्य nodes की तरह मान सकती है। इससे –split-mode tensor विकल्प के साथ आने वाली पुरानी assert error रुक जाती है। अपडेट में K2 Horizon accelerator के लिए SM tensor सपोर्ट भी बहाल किया गया है। यह बदलाव आधिकारिक GitHub रिलीज़ में शामिल है और macOS से लेकर Windows और Linux तक, सूचीबद्ध सभी platforms पर लागू होता है।
यह क्यों मायने रखता है
डेवलपर अब ज़्यादा हार्डवेयर पर split-mode KV caching के साथ llama.cpp चला सकते हैं और क्रैश से बच सकते हैं। इससे स्थानीय LLM inference के लिए इस्तेमाल किए जा सकने वाले कॉन्फ़िगरेशन बढ़ते हैं।