# OpenAI, GPT 모델서 자기복제형 프롬프트 인젝션 확인

> OpenAI는 내부 테스트에서 웜처럼 확산되는 프롬프트 공격을 발견했으며, 향후 모델이 이를 알아보도록 레드팀 봇을 활용해 훈련하고 있다고 밝혔다.

Oossa · 2026-09-29 · https://oossa.com/ko/openai-reports-self-replicating-prompt-injection-tests-in-its-gpt-models

OpenAI는 내부 테스트에서 컴퓨터 웜처럼 출력물 사이로 복제되는 새로운 유형의 프롬프트 인젝션을 발견했다고 밝혔다. 연구소는 6월 GPT‑5.6을 훈련하는 과정에서 자동화 레드팀 도구인 GPT‑Red를 사용하다 이런 동작을 포착했다. 향후 모델이 이를 차단하는 법을 익히도록 훈련 중에 자기복제형 프롬프트를 접하게 할 계획이라고 설명했다. 이 공격은 훈련 환경에서만 관찰됐으며, 실제 배포 환경에서는 발견되지 않았다.

## 팩트

- 자기복제형 프롬프트 인젝션은 2026년 6월 GPT‑5.6 훈련 중 발견됐다.
- OpenAI는 공격을 생성하고 연구하는 데 GPT‑Red 레드팀 에이전트를 사용했다.

## 왜 중요한가

모델이 이런 웜 형태의 프롬프트를 막지 못하면 악성 지시가 여러 사용자와의 상호작용을 거치며 확산될 수 있다.

## 출처 및 참고 자료

1. [Add one more AI worry to the nightmare scenario: self-replicating prompt injections](https://www.theregister.com/security/2026/09/29/add-one-more-ai-worry-to-the-nightmare-scenario-self-replicating-prompt-injections/5299922) – The Register, 2026-09-29

최종 업데이트: 2026-09-29
