أعلن باحثون عن طريقة جديدة باسم ACG-WAM لتعليم الروبوتات كيفية التصرف استنادًا إلى المدخلات البصرية. وفي مجموعة تضم 50 مهمة محاكاة من RoboTwin 2.0، نجح النظام في 93.46% من المحاولات ضمن بيئات خالية من التشويش، و92.68% عندما كانت المشاهد عشوائية. وفي ثلاث مهام على أرض الواقع، حقق نجاحًا كاملًا بنسبة 85.00% ودرجة إنجاز جزئي بلغت 91.67%، متفوقًا على أفضل نظام سابق، Motus، بمقدار 10 و9.17 نقاط مئوية على التوالي.
كيف تعمل ACG-WAM
تضيف الطريقة أداة تنبؤ مساعدة تتعلم استشراف السمات الهندسية، مثل مواقع الأجسام وأشكالها، قبل عدة خطوات، بالاستناد إلى الصورة الحالية من كاميرا الروبوت والإجراءات التي سيتخذها. وتُدرَّب أداة التنبؤ هذه باستخدام أهداف مستمدة من مُشفّر بصري مُجمّد يعالج أزواجًا من الصور الحالية والمستقبلية. وبعد التدريب، تُزال أداة التنبؤ الإضافية ووحدات المعلّم، ليبقى نموذج خفيف يمكن تشغيله على الروبوت.
ما الذي يعنيه ذلك لمستخدمي الروبوتات
تشير معدلات النجاح الأعلى في المحاكاة وعلى الأجهزة الحقيقية إلى أن الروبوتات التي تستخدم ACG-WAM قد تتعلم المهام بموثوقية أكبر، مع حاجة أقل إلى التجربة والخطأ. وبالنسبة إلى الشركات التي تستخدم الروبوتات في المصانع أو المستودعات، قد تقلل الطريقة فترات التوقف الناجمة عن المحاولات الفاشلة، وتختصر الوقت اللازم لتعليم الروبوت سلوكيات جديدة.
لماذا يهم
بالنسبة إلى مدير مصنع، تعني معدلات النجاح الأعلى أن تعليم الروبوتات مهام جديدة قد يصبح أسرع وبأخطاء أقل، ما قد يخفض تكاليف التدريب. لكن الورقة لا تتناول الموثوقية على المدى الطويل أو مدى قابلية الطريقة للتوسع إلى مهام أكثر تعقيدًا، لذا تظل هذه الفوائد بحاجة إلى تأكيد في عمليات نشر أوسع.