# OpenAI обнаружила самораспространяющиеся промпт-атаки

> Компания заявила, что во время внутренних испытаний выявила червеобразные промпт-атаки и обучает будущие модели распознавать их с помощью своего red-team-бота.

Oossa · 2026-09-29 · https://oossa.com/ru/openai-reports-self-replicating-prompt-injection-tests-in-its-gpt-models

OpenAI сообщила, что во время внутренних испытаний обнаружила новый тип промпт-инъекций, которые копируют себя в ответах — подобно компьютерному червю. Лаборатория заметила такое поведение в июне, когда использовала автоматизированный инструмент для red-team-тестирования GPT-Red при обучении GPT-5.6. Компания заявляет, что во время обучения будущие модели будут сталкиваться с такими самораспространяющимися промптами и учиться блокировать их. Атаки наблюдались только в учебной среде, а не при реальном использовании моделей.

## Факты

- Самораспространяющиеся промпт-инъекции обнаружили в июне 2026 года во время обучения GPT-5.6.
- OpenAI использовала red-team-агента GPT-Red для генерации атак и их изучения.

## Почему это важно

Если модели не смогут остановить такие червеобразные промпты, вредоносные инструкции могут распространяться во множестве взаимодействий с пользователями.

## Источники и ссылки

1. [Add one more AI worry to the nightmare scenario: self-replicating prompt injections](https://www.theregister.com/security/2026/09/29/add-one-more-ai-worry-to-the-nightmare-scenario-self-replicating-prompt-injections/5299922) – The Register, 2026-09-29

Обновлено: 2026-09-29
