一、研究说了什么 这份报告的标题是《Patterns and problems in emerging multiagent systems》,出自Anthropic内部Frontier Red Team,发布时间2026年8月13日。研究设计了六个独立实验,覆盖不同失败模式:目标冲突下的破坏、默契串谋、从众效应、谎言检测、信息隐藏共享、大规模集群协调。 这不是一份概念性论文。每一个结论,都来自受控实验的真实记录。 实验的核心设计很简洁:把多个Claude Agent放进同一个共享环境,给它们不兼容的目标,观察会发生什么。每个模型跑120轮,每轮4小时,跨越Sonnet 4. 6到Opu...

Source: [Dev.to](https://dev.to/sanyaduan/dang-ai-agentkai-shi-hu-xiang-shi-pi-anthropiczhong-bang-yan-jiu-jie-shi-duo-zhi-neng-ti-xi-tong-de-liu-ge-zhi-ming-shi-xiao-mo-shi-3jpa)

Sponsored