OossaAIは急速に進化しています。私たちがわかりやすく解説します。

OpenAI、GPTモデルで自己複製型プロンプト攻撃を確認

OpenAIは、社内テストでワームのように広がるプロンプト攻撃を発見したと発表。今後のモデルには、レッドチーム用ボットを使った訓練で攻撃を見分けさせるという。

短信Oossa1 分で読める

OpenAIは、出力をまたいで自らをコピーする、コンピューターウイルスのワームに似た新種のプロンプトインジェクションを社内テストで発見したと発表した。同社の研究チームは6月、GPT-5.6の訓練に自動レッドチームツール「GPT-Red」を使用していた際に、この挙動を確認した。今後のモデルには、こうした自己複製型プロンプトを訓練中に与え、遮断する方法を学ばせるという。攻撃が確認されたのは訓練環境のみで、実際の運用環境では見つかっていない。

なぜ重要か

モデルがこうしたワームのようなプロンプトを阻止できなければ、悪意ある指示が多数のユーザーとのやり取りに広がるおそれがある。

この記事は役に立ちましたか?
共有

次に読む

Oossa · ニュースレター

今週のAIを、わかりやすく

毎週月曜日、知っておきたいニュースをやさしい言葉で。無料・スパムなし。

出典と参考資料

#出典媒体日付要点
1Add one more AI worry to the nightmare scenario: self-replicating prompt injections ↗The Register2026/09/29It's a worm attack, AI-style

1 件の出典

最終更新: ·Markdown·llms.txt