أطلقت Goodfire، وهي شركة ناشئة تدرس آلية عمل نماذج الذكاء الاصطناعي، يوم الخميس 8 أكتوبر 2026 أداة مراقبة «من الداخل إلى الخارج». تقرأ المجسّات إشارات التنشيط الداخلية للنموذج بدلًا من إعادة معالجة مخرجاته. ويمكن لعملاء Baseten اختيار المخاطر التي يريدون مراقبتها والاستجابة الآلية التي ينبغي اتخاذها. وفي اختبار أجرته Goodfire على النموذج المفتوح Kimi K3، بلغت كلفة 1,500 جلسة نحو 51 دولارًا، وتمكنت الأداة من رصد 94% من محاولات الاختراق الخبيثة.
لماذا يهم
يمكن للمطورين الذين يستخدمون نماذج مفتوحة إضافة فحوصات سلامة منخفضة التكلفة من دون تأثير كبير في الأداء.