事件内容
9 月 12 日,Anthropic CEO Dario Amodei 发表长文《We Must Pace the Frontier》,呼吁前沿 AI 实验室主动放缓模型能力提升速度,以便安全研究能够跟上。
文章提出一个核心判断:随着递归自我改进(RSI)加速,以及近期 AI 智能体网络攻击等事件的出现,如果继续以当前速度推进,未来 6–12 个月可能带来大规模风险。为此,他给出“三步走”框架:
- 第三方嵌入式评估:向独立评估者开放与员工同等的系统访问权限,持续审查模型与流程。
- 行业内部协调:前沿实验室自愿同步能力发布节奏,避免单方面抢跑。
- 全球协调:推动政府与企业就安全标准达成一致。
值得注意的是,OpenAI CEO Sam Altman 罕见公开附议,称 OpenAI 也将引入拥有员工级权限的独立评估员;马斯克在 X 上转发并表示“Dario 说得对”。Altman 同期还向《财富》透露,OpenAI 2026 年可能不会 IPO。
为什么值得关注
这是头部 AI 实验室首次公开讨论“主动降速”。它标志着模型能力提升与安全验证之间的矛盾已经从学术圈走到产业台前。然而,承诺能否落地仍取决于商业竞争格局——在“谁先发布谁获益”的囚徒困境下,自愿刹车能否持续,值得持续观察。

评论(0)
暂无评论,来抢沙发~
请 登录 后发表评论