简讯 · 1 分钟阅读
研究发现,编码智能体最多会浪费 22.75% 的任务成本
一项针对 Claude Code 和 Mini-SWE-Agent 的新研究发现,反复检索信息、编写脚本和重复运行测试,是造成额外成本的常见原因。作者表示,在他们的测试中,由开发者编写的指导内容最多可降低 41.73% 的成本。
Oossa · 关于 Oossa
研究人员考察了编码智能体执行 SWE-bench 任务的情况,发现它们反复出现三种资源利用低效的行为:检索已有信息、生成相似脚本,以及重复运行测试。这些行为出现在 79% 至 98% 的任务中,造成的成本最高可达任务总成本的 22.75%。研究团队测试了几种减少浪费的方法,包括由开发者编写指导内容。这种方法最多可降低 41.73% 的成本;自动生成的指导效果较差,而一种检索方法有时反而会增加成本。
为什么重要
对于需要付费运行编码智能体的团队来说,精心编写的开发者指导内容,或许比依赖智能体自行创建指令更能节省成本。
这篇文章有帮助吗?
来源与参考
| # | 来源 | 发布方 | 日期 | 要点 |
|---|---|---|---|---|
| 1 | Analyzing and Mitigating Cost-Inefficient Behaviors in Coding Agents ↗ | arXiv | 2026年9月28日 | arXiv:2609.30725v1 Announce Type: new Abstract: Although effective, coding agents often incur substantial monetary costs. |
1 个来源
最后更新:
Oossa · 新闻简报
一周 AI,讲明白
每周一,用通俗的语言讲清值得知道的新闻。免费,无垃圾邮件。