Replit发布了Replit Agent,这套系统由AI模型自行挑选子代理、设定其规模和工作量,并决定何时重复使用它们。在DeepSWE基准测试中,它以每项任务2.11美元的成本取得72%的成绩,比“副手”方案高出11个百分点。同一Agent在Terminal-Bench上以每项任务2.53美元的成本取得49%的成绩,也超过了基线方案。这一变化让GPT-6 Astra等更强大的模型可以把工作交给成本更低的助手,从而将昂贵的令牌留给最棘手的决策。
为什么重要
让模型自主掌控任务分派,既能提升表现,也能降低开发者的算力成本。