ggml‑org/llama.cpp प्रोजेक्ट ने 2026‑10‑02 को संस्करण b11351 जारी किया। इस अपडेट में ggml_backend_buffer_type_i इंटरफ़ेस में alloc_buffer_n मेथड और ggml_backend_buft_alloc_buffer_n नाम का एक सार्वजनिक API जोड़ा गया है। अब डिफ़ॉल्ट कार्यान्वयन कई डिवाइसों में बफर बाँटने और टेंसरों का बेहतर आवंटन करने की सुविधा देता है। CPU, Metal और OpenVINO जैसे मौजूदा बफर प्रकारों में नए मेथड के लिए NULL प्लेसहोल्डर दिया गया है। नई सुविधा को परखने के लिए टेस्ट भी जोड़े गए हैं।
यह क्यों मायने रखता है
इससे डेवलपर अलग-अलग हार्डवेयर पर मेमोरी को अधिक भरोसेमंद तरीके से संभाल सकेंगे और AI मॉडल में आवंटन संबंधी त्रुटियाँ कम कर सकेंगे।