# OpenAI ontdekt zelfkopiërende promptinjecties in GPT-modellen

> OpenAI zegt tijdens interne tests wormachtige promptaanvallen te hebben ontdekt. Het traint toekomstige modellen met zijn red-team-bot om die te herkennen.

Oossa · 2026-09-29 · https://oossa.com/nl/openai-reports-self-replicating-prompt-injection-tests-in-its-gpt-models

OpenAI maakte bekend dat interne tests een nieuw soort promptinjectie aan het licht hebben gebracht, die zichzelf in uitvoer kopieert, vergelijkbaar met een computerworm. Het lab ontdekte dit gedrag in juni, toen het zijn geautomatiseerde red-teamtool GPT-Red inzette om GPT-5.6 te trainen. Het zegt toekomstige modellen tijdens de training met deze zelfkopiërende prompts in aanraking te brengen, zodat ze leren die tegen te houden. De aanvallen zijn alleen in de trainingsomgeving waargenomen, niet in toepassingen in de praktijk.

## De feiten

- Zelfkopiërende promptinjecties werden in juni 2026 ontdekt tijdens de training van GPT-5.6.
- OpenAI gebruikte zijn red-team-agent GPT-Red om de aanvallen te genereren en te bestuderen.

## Waarom het ertoe doet

Als modellen deze wormachtige prompts niet kunnen tegenhouden, kunnen ze schadelijke instructies verspreiden in een groot aantal gebruikersinteracties.

## Bronnen en referenties

1. [Add one more AI worry to the nightmare scenario: self-replicating prompt injections](https://www.theregister.com/security/2026/09/29/add-one-more-ai-worry-to-the-nightmare-scenario-self-replicating-prompt-injections/5299922) – The Register, 2026-09-29

Laatst bijgewerkt: 2026-09-29
