llama.cpp प्रोजेक्ट ने 30 September 2026 को version b11294 जारी किया। इस अपडेट में Windows के लिए row-prefetching जोड़ी गई है। इससे लाइब्रेरी मॉडल का डेटा पहले से लोड कर सकती है और जनरेशन तेज़ होता है। यह बदलाव Pranesh Gonegandla ने दिया था और बिना किसी और संशोधन के मर्ज किया गया। इसमें कुछ छोटे-मोटे सफ़ाई और बिल्ड से जुड़े सुधार भी शामिल हैं।
यह क्यों मायने रखता है
नई prefetch लॉजिक की बदौलत llama.cpp इस्तेमाल करने वाले Windows यूज़र्स को मॉडल inference तेज़ मिलेगा।