ggml-org टीम ने 2026-10-07 को llama.cpp का b11461 वर्ज़न जारी किया। इस अपडेट में AMD इंटीग्रेटेड GPU पर Vulkan का इस्तेमाल करते समय चेकपॉइंट पढ़ने की धीमी गति ठीक की गई है। इसमें Apple Silicon, Intel Mac, iOS और Linux के कई बिल्ड (CPU, Vulkan, CUDA 12.8) के लिए नए बाइनरी पैकेज भी दिए गए हैं। उपयोगकर्ता GitHub रिलीज़ पेज से अपने लिए सही आर्काइव डाउनलोड कर सकते हैं।
यह क्यों मायने रखता है
AMD लैपटॉप उपयोगकर्ता अब पहले की धीमी गति के बिना LLaMA मॉडल तेज़ी से चला सकते हैं।