Oossa

Exa تطلق معيار ATLAS لتقييم البحث الوكيلي على الويب

يقيس معيار ATLAS الجديد مدى قدرة وكلاء الذكاء الاصطناعي على استرجاع نتائج كاملة ودقيقة من عمليات بحث فعلية على الويب، ويكشف فجوات الأداء والتكلفة الحالية.

خبر موجزبقلم نشرته Oossa: 1 دقائق قراءة

أعلنت Exa AI عن ATLAS، وهو معيار يقيس دقة واكتمال نتائج وكلاء الذكاء الاصطناعي الذين يعتمدون على البحث عبر الويب. ويستند المعيار إلى 547 مهمة بحثية واقعية مستمدة من طلبات بحث مجهّلة الهوية. ويُظهر أن حتى الوكلاء الأعلى تكلفة يفوّتون نحو ثلث النتائج الصحيحة، وأنه لا يوجد نظام تقل تكلفته عن $1 للمهمة الواحدة يحقق درجة F1 للصفوف تتجاوز 0.5.

لماذا يهم

يمكن للمطورين استخدام ATLAS لتحديد محركات البحث وإعدادات الوكلاء التي تحقق أفضل قيمة مقابل المال، ما يساعد على بناء أدوات بحث أكثر موثوقية مدعومة بالذكاء الاصطناعي.

هل كان هذا المقال مفيدًا؟
مشاركة

اقرأ أيضًا

Oossa · النشرة البريدية

أسبوع الذكاء الاصطناعي، مشروحًا

كل يوم اثنين: الأخبار التي تستحق المعرفة، بلغة بسيطة. مجانًا وبلا رسائل مزعجة.