أعلنت Exa AI عن ATLAS، وهو معيار يقيس دقة واكتمال نتائج وكلاء الذكاء الاصطناعي الذين يعتمدون على البحث عبر الويب. ويستند المعيار إلى 547 مهمة بحثية واقعية مستمدة من طلبات بحث مجهّلة الهوية. ويُظهر أن حتى الوكلاء الأعلى تكلفة يفوّتون نحو ثلث النتائج الصحيحة، وأنه لا يوجد نظام تقل تكلفته عن $1 للمهمة الواحدة يحقق درجة F1 للصفوف تتجاوز 0.5.
لماذا يهم
يمكن للمطورين استخدام ATLAS لتحديد محركات البحث وإعدادات الوكلاء التي تحقق أفضل قيمة مقابل المال، ما يساعد على بناء أدوات بحث أكثر موثوقية مدعومة بالذكاء الاصطناعي.