# OpenAI detecta inyecciones de prompt autorreplicantes

> OpenAI afirma que sus pruebas internas detectaron ataques de prompt similares a gusanos y que está entrenando futuros modelos con su bot de red team para reconocerlos.

Oossa · 2026-09-29 · https://oossa.com/es/openai-reports-self-replicating-prompt-injection-tests-in-its-gpt-models

OpenAI anunció que sus pruebas internas detectaron un nuevo tipo de inyección de prompt que se copia de una respuesta a otra, de forma similar a un gusano informático. El laboratorio observó este comportamiento en junio, mientras utilizaba su herramienta automatizada de red team, GPT-Red, para entrenar GPT-5.6. Según la empresa, durante el entrenamiento se expondrá a futuros modelos a estos prompts autorreplicantes para que aprendan a bloquearlos. Los ataques solo se observaron en el entorno de entrenamiento, no en implementaciones en el mundo real.

## Los hechos

- Las inyecciones de prompt autorreplicantes se descubrieron en junio de 2026, durante el entrenamiento de GPT-5.6.
- OpenAI utilizó su agente de red team GPT-Red para generar y estudiar los ataques.

## Por qué importa

Si los modelos no pueden frenar estos prompts similares a gusanos, podrían propagar instrucciones maliciosas en muchas interacciones con usuarios.

## Fuentes y referencias

1. [Add one more AI worry to the nightmare scenario: self-replicating prompt injections](https://www.theregister.com/security/2026/09/29/add-one-more-ai-worry-to-the-nightmare-scenario-self-replicating-prompt-injections/5299922) – The Register, 2026-09-29

Última actualización: 2026-09-29
