Oossa

نسخه b11351، API تازه‌ای برای تخصیص بافر به llama.cpp آورد

به‌روزرسانی 2 اکتبر 2026، تابع alloc_buffer_n را به رابط بافر ggml اضافه می‌کند و مدیریت حافظه در چند دستگاه را بهبود می‌دهد.

خبر کوتاهOossaمنتشرشده توسط Oossa: 1 دقیقه مطالعه

پروژه ggml‑org/llama.cpp نسخه b11351 را در 2026-10-02 منتشر کرد. این به‌روزرسانی متد alloc_buffer_n را به رابط ggml_backend_buffer_type_i اضافه می‌کند و یک API عمومی با نام ggml_backend_buft_alloc_buffer_n ارائه می‌دهد. پیاده‌سازی پیش‌فرض اکنون از تقسیم بافرها میان چند دستگاه و تخصیص بهتر تنسورها پشتیبانی می‌کند. برای انواع بافر موجود، مانند CPU، Metal، OpenVINO و موارد دیگر، مقدار جای‌نگهدار NULL برای متد جدید در نظر گرفته شده است. همچنین برای آزمایش قابلیت تازه، تست‌هایی اضافه شده‌اند.

چرا مهم است

توسعه‌دهندگان اکنون می‌توانند حافظه را روی سخت‌افزارهای گوناگون مطمئن‌تر مدیریت کنند و خطاهای تخصیص حافظه در مدل‌های هوش مصنوعی را کاهش دهند.

آیا این مقاله مفید بود؟
اشتراک‌گذاری

بیشتر بخوانید

Oossa · خبرنامه

هفتهٔ هوش مصنوعی، به زبان ساده

هر دوشنبه: خبرهایی که ارزش دانستن دارند، به زبان ساده. رایگان و بدون هرزنامه.