研究AI模型运作机制的初创公司Goodfire于2026年10月8日(周四)发布了一款“由内而外”的监控工具。探针读取模型的内部激活信号,而不是重新处理模型输出。Baseten客户可以选择要监测的风险,以及采取何种自动化应对措施。在Goodfire针对开放模型Kimi K3进行的测试中,监控1,500次会话的费用约为$51,并成功识别出94%的恶意黑客攻击。
为什么重要
使用开放模型的开发者可以以较低成本加入安全检查,同时避免明显影响性能。
这款新探针监测模型的内部信号;监控1,500次会话收费$51,而较便宜的替代方案也要$233。
简讯作者: OossaOossa 发布日期: 1 分钟阅读
研究AI模型运作机制的初创公司Goodfire于2026年10月8日(周四)发布了一款“由内而外”的监控工具。探针读取模型的内部激活信号,而不是重新处理模型输出。Baseten客户可以选择要监测的风险,以及采取何种自动化应对措施。在Goodfire针对开放模型Kimi K3进行的测试中,监控1,500次会话的费用约为$51,并成功识别出94%的恶意黑客攻击。
使用开放模型的开发者可以以较低成本加入安全检查,同时避免明显影响性能。
Oossa · 新闻简报
一周 AI,讲明白
每周一,用通俗的语言讲清值得知道的新闻。免费,无垃圾邮件。