# NVIDIA presenta PivotOPD, un método para agentes de IA con varios turnos

> Investigadores presentaron PivotOPD, una técnica de entrenamiento que ayuda a los agentes basados en modelos de lenguaje grandes a evitar errores iniciales en las conversaciones y corregirlos.

Oossa · 2026-10-08 · https://oossa.com/es/nvidia-introduces-pivotopd-method-for-multi-turn-ai-agents

Investigadores de NVIDIA anunciaron un nuevo método de entrenamiento llamado PivotOPD. Es una técnica de destilación on-policy —una forma de enseñar a la IA mientras interactúa— diseñada para agentes basados en modelos de lenguaje grandes (LLM) que mantienen conversaciones de varios turnos. El método enseña a los agentes a detectar errores decisivos al principio del diálogo y a recuperarse de ellos. En las pruebas, PivotOPD obtuvo la puntuación media más alta entre 13 enfoques competidores en tres pruebas de referencia estándar para agentes.

## Los hechos

- PivotOPD obtuvo la mejor puntuación media frente a 13 métodos de referencia en 3 pruebas de referencia para agentes.
- El anuncio se publicó el 08 de octubre de 2026.

## Por qué importa

Una mejor capacidad para corregir errores podría hacer que las herramientas de IA conversacional sean más fiables para quienes necesitan interacciones más largas y con varios pasos.

## Fuentes y referencias

1. [NVIDIA PivotOPD Teaches Multi-Turn AI Agents to Recover From Pivotal Mistakes](https://www.marktechpost.com/2026/10/08/nvidia-pivotopd-teaches-multi-turn-ai-agents-to-recover-from-pivotal-mistakes/) – MarkTechPost, 2026-10-08

Última actualización: 2026-10-08
