多智能体软件工程:单一编码智能体已不足够
如今的编码代理已经相当出色:它们能够编写函数、修复失败的测试用例,或引导你梳理那些你本不想阅读的遗留代码片段。这部分已尘埃落定。更具挑战性的问题是:当你将一个真实的交付任务交给它们时——这项任务需要同时修改数据库、API、前端界面和测试套件,并在你离开办公桌后持续运行——会发生什么?通常,单个代理在此类场景下会陷入困境,但这并非因为模型不够智能。真正的瓶颈在于人类的注意力。一个团队可能有五十项积压任务等待代理协助,但总得有人对每一项进行范围界定、全程监控、审查产出结果,并确认其实际有效。因此,尽管代码生成速度远超以往,交付节奏却并未显著加快。慢的环节只是发生了转移。