ggml-org ने llama.cpp का संस्करण b11537 जारी किया। इस अपडेट में एम्बेडिंग के लिए graph get_rows का क्रम बदला गया है और Gemma4 में एम्बेडिंग हैंडलिंग से जुड़ी समस्याएं ठीक की गई हैं। इसमें LoRA सपोर्ट के लिए TODO नोट भी जोड़ा गया है और raw embedding पाथ सुधारे गए हैं। अब macOS Apple Silicon, macOS Intel, iOS और Ubuntu के कई बिल्ड के लिए पहले से कंपाइल किए गए बाइनरी उपलब्ध हैं, जिनमें Vulkan-सक्षम संस्करण भी शामिल हैं।
यह क्यों मायने रखता है
डेवलपर अब सुधारे गए एम्बेडिंग सपोर्ट के साथ अधिक प्लेटफ़ॉर्म पर llama.cpp स्थानीय रूप से चला सकते हैं, जिससे सेटअप की झंझट कम होगी।