ggml-org टीम ने llama.cpp का b11268 संस्करण जारी किया। इस अपडेट में OpenCL ड्राइवर का वह बग ठीक किया गया है, जो Adreno GPU के q5_K कर्नेल के लिए टेंसर हैंडल करता था। macOS Apple Silicon, Intel Mac, iOS और Linux के कई कॉन्फ़िगरेशन—जिनमें CPU, Vulkan और CUDA 12.8 शामिल हैं—के लिए पहले से बने नए बाइनरी भी उपलब्ध कराए गए हैं।
यह क्यों मायने रखता है
यह सुधार Adreno GPU वाले Android डिवाइसों पर LLM चलाने वाले डेवलपर्स के लिए प्रदर्शन और स्थिरता बेहतर करता है।