نشر فريق ggml-org إصدارًا تجريبيًا من llama.cpp يحمل الرقم b11532. ويضيف التحديث دالة التنشيط GELU الدقيقة لمشفّرات ModernBERT، مع الإبقاء على الأسماء البديلة لـ tanh-GELU. كما يربط دالة GELU في Python بتنفيذ أكثر دقة. ويتضمن الإصدار نسخًا مبنية لمنصات عديدة، من أجهزة Mac المزودة بمعالجات Apple Silicon إلى Windows مع CUDA 13.4. وقد وُقّع الكود المصدري بمفتاح GPG موثّق.
لماذا يهم
يمكن للمطورين تشغيل نماذج ModernBERT محليًا باستخدام دوال تنشيط أدق، ما يحسّن جودة الاستدلال من دون الحاجة إلى الخدمات السحابية.