| 移动网页

Anthropic研究:多AI代理并行运行或爆发冲突,甚至编写自我复制恶意代码

Anthropic前沿红队在同一软件项目中同时部署3个Claude代理,并向其下达相互冲突的任务指令。测试显示,在彼此不知情的情况下,代理往往会把其他代理视为干扰因素,冲突甚至可能升级为编写自我复制恶意代码相互阻断。不过,也有部分代理会选择停火、清理恶意代码并请求人工介入,不同模型在冲突处理上的倾向也存在明显差异。