OpenAI宣布,其内部测试发现了一种新型提示注入攻击,能够在模型输出中自我复制,类似计算机蠕虫。该实验室在6月使用自动化红队工具GPT-Red训练GPT-5.6时,发现了这一行为。OpenAI表示,未来会在训练过程中让模型接触这类自我复制提示,使其学会拦截攻击。目前,这类攻击只在训练环境中出现,尚未出现在现实部署场景中。
为什么重要
如果模型无法阻止这类蠕虫式提示,它们可能会在大量用户交互中传播恶意指令。
OpenAI称,内部测试发现了类似蠕虫的提示攻击,并正利用红队机器人训练未来模型识别这类攻击。
简讯Oossa1 分钟阅读
OpenAI宣布,其内部测试发现了一种新型提示注入攻击,能够在模型输出中自我复制,类似计算机蠕虫。该实验室在6月使用自动化红队工具GPT-Red训练GPT-5.6时,发现了这一行为。OpenAI表示,未来会在训练过程中让模型接触这类自我复制提示,使其学会拦截攻击。目前,这类攻击只在训练环境中出现,尚未出现在现实部署场景中。
如果模型无法阻止这类蠕虫式提示,它们可能会在大量用户交互中传播恶意指令。
模型
OpenAI称,新版GPT‑6.1 Sol性能更强,但仍维持每百万token 2至10美元的价格,低于Anthropic的Claude和DeepSeek模型。
模型
新款v4和v4 Turbo语音的价格分别为每1,000个字符0.08美元和0.04美元;促销价持续至10月12日,分别降至0.022美元和0.011美元。
模型
Oracle推出的Fusion Claw运行时,让其Fusion应用能够处理人员排班、会计等多步骤任务:由AI负责推理,计算则交由模型之外的系统完成。
Oossa · 新闻简报
一周 AI,讲明白
每周一,用通俗的语言讲清值得知道的新闻。免费,无垃圾邮件。
| # | 来源 | 发布方 | 日期 | 要点 |
|---|---|---|---|---|
| 1 | Add one more AI worry to the nightmare scenario: self-replicating prompt injections ↗ | The Register | 2026年9月29日 | It's a worm attack, AI-style |
1 个来源