أصدر مشروع ggml-org/llama.cpp الإصدار b11351 في 2026-10-02. ويضيف التحديث الدالة alloc_buffer_n إلى الواجهة ggml_backend_buffer_type_i، مع واجهة برمجية عامة باسم ggml_backend_buft_alloc_buffer_n. ويدعم التنفيذ الافتراضي الآن تقسيم المخازن المؤقتة بين أجهزة متعددة وتحسين تخصيص الموترات. أما أنواع المخازن المؤقتة الحالية، مثل CPU وMetal وOpenVINO وغيرها، فتحصل على قيمة NULL للدالة الجديدة. كما أُضيفت اختبارات للتحقق من الوظائف الجديدة.
لماذا يهم
يمكن للمطورين الآن إدارة الذاكرة بموثوقية أكبر على مجموعة متنوعة من الأجهزة، ما يقلل أخطاء التخصيص في نماذج الذكاء الاصطناعي.