پروژه ggml‑org/llama.cpp نسخه b11351 را در 2026-10-02 منتشر کرد. این بهروزرسانی متد alloc_buffer_n را به رابط ggml_backend_buffer_type_i اضافه میکند و یک API عمومی با نام ggml_backend_buft_alloc_buffer_n ارائه میدهد. پیادهسازی پیشفرض اکنون از تقسیم بافرها میان چند دستگاه و تخصیص بهتر تنسورها پشتیبانی میکند. برای انواع بافر موجود، مانند CPU، Metal، OpenVINO و موارد دیگر، مقدار جاینگهدار NULL برای متد جدید در نظر گرفته شده است. همچنین برای آزمایش قابلیت تازه، تستهایی اضافه شدهاند.
چرا مهم است
توسعهدهندگان اکنون میتوانند حافظه را روی سختافزارهای گوناگون مطمئنتر مدیریت کنند و خطاهای تخصیص حافظه در مدلهای هوش مصنوعی را کاهش دهند.