Replitは、AIモデル自身がサブエージェントを選び、その規模や投入する労力を決め、再利用するタイミングも判断するシステム「Replit Agent」を公開した。DeepSWEベンチマークでは、1タスクあたり2.11ドルで72%を記録し、サイドキック構成を11ポイント上回った。同じAgentはTerminal-Benchでも、1タスクあたり2.53ドルで49%を達成し、ベースラインを上回った。この変更により、GPT-6 Astraのような高性能モデルは、作業をより安価な補助モデルに委任し、難しい判断に高コストのトークンを温存できる。
なぜ重要か
モデル自身にタスクの委任を任せることで、開発者の計算コストを抑えながら性能を高められる。