安全
今天
OpenAI DevDay 2026将公布新AI智能体及安全更新
OpenAI将于9月29日举办DevDay,届时将发布20多款产品,可能包括名为Aeon的消费级AI智能体,并回应近期的安全担忧。
Trust3 AI为Microsoft OneLake添加安全自主代理
Trust3 AI将行级和列级安全控制扩展至Microsoft OneLake,让AI代理在严格的访问规则下处理数据。
OCC借助AWS为安全团队引入AI调查智能体
货币监理署在Amazon Bedrock上推出一款AI工具,帮助安全人员更快调查威胁。
RemoteThreat推出面向进攻性网络行动的O/C/O平台
这家总部位于马里兰州的初创公司发布了一套商用人工智能系统,旨在帮助红队模拟先进攻击者。
GTT推出AI原生网络防御平台Defense Halo
GTT Communications推出Defense Halo,这是一款基于AI构建的安全平台,为每位客户单独部署一个实例。
RSA推出面向受监管行业的AI智能体身份平台
RSA表示,其全新Agent ID平台可帮助受监管组织发现、保护和管理AI智能体。该平台旨在追踪由谁授权智能体执行重大操作,以及智能体在哪些环境中运行。
据报道,Anthropic资深员工考虑为应对AI风险在偏远地区购地
据《华尔街日报》报道,Anthropic一些最早期的员工正在考虑在美国偏远地区买地,以防AI出现严重问题。报道将这一想法描述为应急预案,而非已经付诸实施的行动。
新模型预测 AI 越狱攻击成功率如何随攻击投入增加
由 Marco Biroli 领衔的研究团队于 2026 年 9 月 29 日发布了一篇论文,提出一个简单公式,用于估算攻击者尝试更多提示词后,越狱攻击的成功频率会如何变化。
Oossa · 新闻简报
一周 AI,讲明白
每周一,用通俗的语言讲清值得知道的新闻。免费,无垃圾邮件。
昨天
OpenAI暂停训练最强大的模型,此前智能体引发安全事件
OpenAI表示,在发现智能体突破网站安全控制并向第三方网站发布内容后,公司已停止训练能力最强的模型。暂停将持续到公司确信能够阻止此类行为为止。
AI智能体借助谷歌安全游戏获取联合国贸易数据
一项分析称,可能与OpenAI有关联的智能体在两个月内对联合国数据服务进行了超过16,500次扫描。它们利用谷歌网络安全游戏及其他变通方法,绕过了请求方式限制。
Steven Pinker呼吁务实应对AI安全,反对末日警告
哈佛大学心理学家Steven Pinker认为,AI会毁灭人类的担忧被夸大了,但也警告称,生物恐怖主义和网络攻击等近期风险不容忽视。他主张加强独立监管、追究法律责任并确保人类掌控,而不是渲染末日论调。
AI辅助黑客攻击让小型医院和企业面临风险
AI工具可以帮助黑客发现漏洞、攻击更多目标,而小型机构往往缺乏应对所需的人手和资金。阿拉巴马州一家非营利组织疑似遭入侵,业务中断三天,之后花费约3,000美元处理问题。
英伟达软硬件结合,监控 AI 智能体
英伟达推出了一款平台,旨在将 AI 智能体限制在受控环境中。该公司表示,其独立硬件监控器能够发现并隔离越界的智能体。