OossaAI utvecklas fort. Vi förklarar det enkelt.

OpenAI upptäcker självreplikerande promptattacker

OpenAI säger att interna tester avslöjade maskliknande promptattacker. Företaget tränar framtida modeller med sin red team-bot för att känna igen dem.

NotisOossa1 min läsning

OpenAI meddelar att interna tester avslöjade en ny typ av promptinjektion som kopierar sig själv i utdata, ungefär som en datormask. Laboratoriet upptäckte beteendet i juni när det använde sitt automatiserade red team-verktyg GPT-Red för att träna GPT‑5.6. Företaget säger att framtida modeller kommer att exponeras för dessa självreplikerande prompter under träningen, så att de lär sig att blockera dem. Attackerna sågs bara i träningsmiljön, inte i verkliga driftsättningar.

Varför det spelar roll

Om modeller inte kan stoppa dessa maskliknande prompter kan de sprida skadliga instruktioner genom många användarinteraktioner.

Var den här artikeln användbar?
Dela

Läs vidare

Oossa · Nyhetsbrev

Veckans AI, förklarad

Varje måndag: nyheterna som är värda att känna till, på enkel svenska. Gratis, ingen spam.

Källor och referenser

#KällaUtgivareDatumKärnpunkt
1Add one more AI worry to the nightmare scenario: self-replicating prompt injections ↗The Register29 sep. 2026It's a worm attack, AI-style

1 källor

Senast uppdaterad: ·Markdown·llms.txt