# نسخه b11351، API تازه‌ای برای تخصیص بافر به llama.cpp آورد

> به‌روزرسانی 2 اکتبر 2026، تابع alloc_buffer_n را به رابط بافر ggml اضافه می‌کند و مدیریت حافظه در چند دستگاه را بهبود می‌دهد.

Oossa · 2026-10-02 · https://oossa.com/fa/llama-cpp-adds-new-buffer-allocation-api-in-b11351-release

پروژه ggml‑org/llama.cpp نسخه b11351 را در 2026-10-02 منتشر کرد. این به‌روزرسانی متد alloc_buffer_n را به رابط ggml_backend_buffer_type_i اضافه می‌کند و یک API عمومی با نام ggml_backend_buft_alloc_buffer_n ارائه می‌دهد. پیاده‌سازی پیش‌فرض اکنون از تقسیم بافرها میان چند دستگاه و تخصیص بهتر تنسورها پشتیبانی می‌کند. برای انواع بافر موجود، مانند CPU، Metal، OpenVINO و موارد دیگر، مقدار جای‌نگهدار NULL برای متد جدید در نظر گرفته شده است. همچنین برای آزمایش قابلیت تازه، تست‌هایی اضافه شده‌اند.

## حقایق

- نسخه b11351 در 2026-10-02 منتشر شد
- متد جدید alloc_buffer_n به رابط بافر ggml اضافه شد

## چرا مهم است

توسعه‌دهندگان اکنون می‌توانند حافظه را روی سخت‌افزارهای گوناگون مطمئن‌تر مدیریت کنند و خطاهای تخصیص حافظه در مدل‌های هوش مصنوعی را کاهش دهند.

## منابع و ارجاع‌ها

1. [ggml-org/llama.cpp b11351](https://github.com/ggml-org/llama.cpp/releases/tag/b11351) – llama.cpp, 2026-10-02

آخرین به‌روزرسانی: 2026-10-02
