# llama.cpp b11351 में नया बफर आवंटन API

> 2 अक्तूबर 2026 के अपडेट में ggml के बफर इंटरफ़ेस में alloc_buffer_n जोड़ा गया है, जिससे कई डिवाइसों की मेमोरी संभालना बेहतर होगा।

Oossa · 2026-10-02 · https://oossa.com/hi/llama-cpp-adds-new-buffer-allocation-api-in-b11351-release

ggml‑org/llama.cpp प्रोजेक्ट ने 2026‑10‑02 को संस्करण b11351 जारी किया। इस अपडेट में ggml_backend_buffer_type_i इंटरफ़ेस में alloc_buffer_n मेथड और ggml_backend_buft_alloc_buffer_n नाम का एक सार्वजनिक API जोड़ा गया है। अब डिफ़ॉल्ट कार्यान्वयन कई डिवाइसों में बफर बाँटने और टेंसरों का बेहतर आवंटन करने की सुविधा देता है। CPU, Metal और OpenVINO जैसे मौजूदा बफर प्रकारों में नए मेथड के लिए NULL प्लेसहोल्डर दिया गया है। नई सुविधा को परखने के लिए टेस्ट भी जोड़े गए हैं।

## तथ्य

- संस्करण b11351, 2026‑10‑02 को जारी हुआ
- ggml के बफर इंटरफ़ेस में नया alloc_buffer_n मेथड जोड़ा गया

## यह क्यों मायने रखता है

इससे डेवलपर अलग-अलग हार्डवेयर पर मेमोरी को अधिक भरोसेमंद तरीके से संभाल सकेंगे और AI मॉडल में आवंटन संबंधी त्रुटियाँ कम कर सकेंगे।

## स्रोत और संदर्भ

1. [ggml-org/llama.cpp b11351](https://github.com/ggml-org/llama.cpp/releases/tag/b11351) – llama.cpp, 2026-10-02

अंतिम अपडेट: 2026-10-02
