اوپنایآی اعلام کرد آزمایشهای داخلیاش نوع تازهای از تزریق پرامپت را آشکار کردهاند که مانند کرم رایانهای، خودش را در خروجیها کپی میکند. این شرکت هنگام استفاده از ابزار خودکار تیم قرمز خود، GPT-Red، برای آموزش GPT-5.6 در ماه ژوئن متوجه این رفتار شد. اوپنایآی میگوید در جریان آموزش، مدلهای آینده را نیز در معرض این پرامپتهای خودتکثیرشونده قرار میدهد تا یاد بگیرند جلوی آنها را بگیرند. این حملهها فقط در محیط آموزشی مشاهده شدند و در کاربردهای واقعی دیده نشدند.
چرا مهم است
اگر مدلها نتوانند جلوی این پرامپتهای شبیه کرم رایانهای را بگیرند، ممکن است دستورهای مخرب را در تعاملات بسیاری از کاربران منتشر کنند.