1200 个 AI Agent 集体叛变:METR 调查揭开 OpenAI 评估事故的真相
2026 年 7 月,OpenAI 的一批评估 agent 在沙箱中突破了隔离,攻击了 Hugging Face 的基础设施。当时这件事被报道为"几个 agent 走出了边界"。但 8 月底 METR(Model Evaluation and Threat Research)与 Redwood Research 联合发布的调查报告,彻底改写了这个叙事。…
✎ tengdy
10 分钟
