أصدر فريق ggml‑org الإصدار b11324 من llama.cpp. ويضيف التحديث وضع ربط الذاكرة، الذي يتجنب إنشاء نسخة ثانية كاملة الحجم من كل موتر عند تحميل النماذج. ويتوفر التغيير ضمن حزم ثنائية جديدة لأنظمة macOS (Apple Silicon وIntel) وiOS وعدة إصدارات من Ubuntu. كما يشير الإصدار إلى مساهمات من Claude ومهندس NVIDIA برانيش غونيغاندلا.
لماذا يهم
يمكن للمطورين تشغيل نماذج لغوية أكبر على الأجهزة نفسها، ما يفيد الهواة والفرق الصغيرة ذات الذاكرة المحدودة.