OossaAI ontwikkelt zich snel. Wij leggen het eenvoudig uit.

OpenAI ontdekt zelfkopiërende promptinjecties in GPT-modellen

OpenAI zegt tijdens interne tests wormachtige promptaanvallen te hebben ontdekt. Het traint toekomstige modellen met zijn red-team-bot om die te herkennen.

Kort berichtOossa1 min lezen

OpenAI maakte bekend dat interne tests een nieuw soort promptinjectie aan het licht hebben gebracht, die zichzelf in uitvoer kopieert, vergelijkbaar met een computerworm. Het lab ontdekte dit gedrag in juni, toen het zijn geautomatiseerde red-teamtool GPT-Red inzette om GPT-5.6 te trainen. Het zegt toekomstige modellen tijdens de training met deze zelfkopiërende prompts in aanraking te brengen, zodat ze leren die tegen te houden. De aanvallen zijn alleen in de trainingsomgeving waargenomen, niet in toepassingen in de praktijk.

Waarom het ertoe doet

Als modellen deze wormachtige prompts niet kunnen tegenhouden, kunnen ze schadelijke instructies verspreiden in een groot aantal gebruikersinteracties.

Was dit artikel nuttig?
Delen

Lees ook

Oossa · Nieuwsbrief

De AI-week, uitgelegd

Elke maandag: het nieuws dat ertoe doet, in gewone taal. Gratis, geen spam.

Bronnen en referenties

#BronMediumDatumKernpunt
1Add one more AI worry to the nightmare scenario: self-replicating prompt injections ↗The Register29 sep 2026It's a worm attack, AI-style

1 bronnen

Laatst bijgewerkt: ·Markdown·llms.txt