پژوهشگران NVIDIA روش آموزشی تازهای به نام PivotOPD معرفی کردند. این روش نوعی تقطیر درونسیاستی است؛ یعنی راهی برای آموزش هوش مصنوعی هنگام تعامل با آن، که برای عاملهای مدل زبانی بزرگِ چندنوبتی طراحی شده است. PivotOPD به عاملها آموزش میدهد اشتباههای تعیینکننده را در ابتدای گفتگو تشخیص دهند و از آنها بازیابی کنند. در آزمایشها، PivotOPD در میان 13 روش رقیب، در سه معیار استاندارد سنجش عاملها بالاترین میانگین امتیاز را کسب کرد.
چرا مهم است
توانایی بهتر در اصلاح اشتباهها میتواند ابزارهای هوش مصنوعی مکالمهای را برای کاربرانی که به تعاملهای طولانیتر و چندمرحلهای نیاز دارند، قابلاعتمادتر کند.