ggml‑org/llama.cpp प्रोजेक्ट ने 2026‑10‑09 को संस्करण b11530 जारी किया। इस बदलाव से बैकएंड सैंपलिंग ग्राफ़ सभी ubatches में स्थिर रहता है, इसलिए रिज़र्व और डिकोड चरणों के दौरान ग्राफ़ का आकार नहीं बदलता। इससे रिज़र्व बिल्ड के बाद ग्राफ़ की टोपोलॉजी बदलने पर होने वाले क्रैश ठीक होते हैं। यह सुधार सभी सूचीबद्ध बिल्ड—macOS, Linux, Android, Windows और openEuler—और CUDA, Vulkan तथा OpenCL जैसे सभी हार्डवेयर बैकएंड पर लागू होता है।
यह क्यों मायने रखता है
llama.cpp का इस्तेमाल करने वाले डेवलपर किसी भी समर्थित CPU या GPU पर मल्टी-आउटपुट जनरेशन चलाते समय कम रनटाइम त्रुटियां देखेंगे।