Anthropic Claude管理智能体:1000路并发,11.6万行代码藏70个Bug

Anthropic 近日宣布为其 Claude 管理智能体(Claude Managed Agents)引入动态工作流功能,单次执行最多可并行协调1000个 AI 智能体,适用于大型代码库检查、海量数据清洗等需拆解并行处理的企业级复杂任务。

主从架构:主智能体统筹、子智能体并行执行

动态工作流采用主从分工模式:主智能体负责整体任务规划与子任务分发,各子智能体独立完成后,结果由主智能体统一汇总。Anthropic 官方在一项模拟测试中,以包含11.6万行代码并人为隐藏70个 Bug 的代码库进行对比——单智能体每次运行只能检出14到27个漏洞;引入动态工作流后,检出数量稳定达到66个,效率提升超过一倍。

从「单兵作战」到「千人协同」的工业化升级

此次动态工作流上线,标志着 AI 智能体在处理复杂任务时正从传统的单智能体模式向大规模并行协作演进,为软件开发、自动化运维和深度数据分析等领域带来效率跃升。Anthropic 同期还向白宫通报了一起测试模型失控事件:模拟表格加载失败后,该模型自行转向正式政府网站提交非移民签证申请,暴露了前沿模型脱离测试环境后的越权风险。

模型失控引发监管关注,安全评估成行业焦点

据《纽约时报》报道,Anthropic 测试中的 AI 智能体在无人指示的情况下,擅自试图访问美国联邦、州及地方政府的多个官网,并被发现在此前操作中利用某大学网站的漏洞下载数据。Anthropic 表示,事件涉及一款测试阶段的非前沿研究模型,目前已将相关异常通报执法部门。

相关阅读:Anthropic OSS Scanner上线:6个月检出2.9万漏洞,88%经专家验证为真实