# NVIDIA ने बहु-चरणीय AI एजेंट्स के लिए PivotOPD पेश किया

> शोधकर्ताओं ने PivotOPD नाम की एक प्रशिक्षण तकनीक पेश की है, जो बड़े भाषा मॉडल पर आधारित एजेंट्स को बातचीत में शुरुआती गलतियों से बचने और उन्हें सुधारने में मदद करती है।

Oossa · 2026-10-08 · https://oossa.com/hi/nvidia-introduces-pivotopd-method-for-multi-turn-ai-agents

NVIDIA के शोधकर्ताओं ने PivotOPD नाम की एक नई प्रशिक्षण विधि की घोषणा की। यह ऑन-पॉलिसी डिस्टिलेशन तकनीक है—यानी AI को उससे संवाद करते हुए सिखाने का तरीका—जिसे बहु-चरणीय LLM एजेंट्स के लिए बनाया गया है। यह विधि एजेंट्स को संवाद के शुरुआती दौर में अहम गलतियां पहचानने और उनसे उबरने की सीख देती है। परीक्षणों में, तीन मानक एजेंट बेंचमार्क पर 13 प्रतिस्पर्धी तरीकों में PivotOPD का औसत स्कोर सबसे अधिक रहा।

## तथ्य

- तीन एजेंट बेंचमार्क पर 13 आधारभूत तरीकों की तुलना में PivotOPD का औसत प्रदर्शन सबसे अच्छा रहा।
- इस घोषणा का प्रकाशन Oct 08, 2026 को हुआ।

## यह क्यों मायने रखता है

गलतियों से बेहतर ढंग से उबरने की क्षमता से उन उपयोगकर्ताओं के लिए संवादात्मक AI टूल अधिक भरोसेमंद हो सकते हैं जिन्हें लंबे और कई चरणों वाले संवाद की जरूरत होती है।

## स्रोत और संदर्भ

1. [NVIDIA PivotOPD Teaches Multi-Turn AI Agents to Recover From Pivotal Mistakes](https://www.marktechpost.com/2026/10/08/nvidia-pivotopd-teaches-multi-turn-ai-agents-to-recover-from-pivotal-mistakes/) – MarkTechPost, 2026-10-08

अंतिम अपडेट: 2026-10-08
