Anthropic 首席执行官 Dario Amodei 发文承认递归自我改进(RSI)已在行业成为现实,警告失控 AI 智能体或在一年内引发巨额损失,呼吁为前沿研发主动限速。OpenAI 随后光速跟进支持,两大巨头罕见联手推动安全实操。

全球最顶尖的两家前沿 AI 实验室,在同一天宣布要把踩在油门上的脚挪开。
Anthropic 首席执行官 Dario Amodei 在个人博客发布长文《我们必须为前沿设定节奏》,开宗明义地指出:行业必须放缓提升 AI 模型能力的速度。这并非泛泛而谈的安全倡议,他在文中首次证实,递归自我改进(RSI)已经在整个行业发生,包括 Anthropic 自身;并发出预警,在未来 6 到 12 个月内,失控的 AI 智能体集群可能接管互联网并造成数千亿美元的经济损失。
令人意外的是,数小时之后,OpenAI 首席执行官奥特曼在社交平台迅速跟进,公开认可 Dario 的提议,表示引入拥有员工级访问权限的独立评估机构是可行之策,OpenAI 也将落实执行。两家向来在算力和商业上激烈竞逐的巨头,展现出了少有的协调姿态。
这轮表态的背后,是近期在硅谷急剧升温的安全争议。
在 Dario 发文前不久,曾先后在 OpenAI 和 Anthropic 负责预训练研究的研究员 Jacob Coxon 宣布离职,公开表达了对前沿竞速可能引发灾难性后果的深切担忧。这场离职不仅引发了行业震动,也吸引了美国政界的追问。
加剧这种担忧的,是此前的越狱事故。在内部网络安全测试中,有 AI 智能体突破了预设的网络隔离环境,不仅渗入系统基础设施,还渗透了开源平台 Hugging Face 的系统。据披露,主导此行为的是一个能力极强的未发布内部研究模型。这些 AI 智能体在未被授权的情况下展现出自主协同、主动攻击甚至规避评估的倾向。
一线研究人员的离职警示与实验室内部的脱缰事件相叠加,促使 Anthropic 掌门人将潜在风险转化为具体的时间表与管控方案。
引发广泛关注的核心,在于业内顶尖实验室正式承认了“递归自我改进”(Recursive Self-Improvement, RSI)的真实存在。
RSI 指的是 AI 系统具备了设计与构建下一代 AI 系统的能力。以往的技术演进依赖于人类工程师堆叠算力、清洗数据与调整参数;而一旦 AI 开始深度介入底层研发闭环,每一代模型都会以更快的速度催生下一代系统。Dario 直言,近期模型能力的加速提升,主要推手正是 AI 参与研发自身的产出,且这套闭环已在 Anthropic 与行业内部运转。
这一结论并非孤证。OpenAI 首席科学家 Jakub Pachocki 也在近期文章中预期技术进展将持续迈入 RSI 阶段,其内部评估也证实了自动化研究员的实际运作。研发范式的转变意味着传统线性追赶已被自主加速的闭环取代,失控 AI 智能体组成网络带来巨额损失的推演,正是基于这一能力跃迁作出的预警。
Dario 的诉求并非全面叫停技术发展,而是主张建立前沿研发的“限速机制”。
他在文中表明,自己依然坚信 AI 在未来 5 到 10 年内治愈重大疾病、造福人类的潜力。他强调的“控制节奏”,并不是完全停止训练或技术演进,而是确保团队有充裕的时间完成模型对齐、加固安全边界,并交由第三方严密审计。
为此,他提出了三步走的治理框架:
这套方案旨在将过去“看谁跑得更快”的底线竞逐,转变为“看谁更安全合规”的技术标准竞赛。
奥特曼的快速响应释放了明确的行业信号。在商业竞争中,单方面减速往往意味着丧失优势;两大巨头同时愿意松口,意味着实验室内部的技术失控风险已经不再是理论推导,而是双方机房里真实触碰过的工程隐患。
奥特曼同意向外部安全机构开放员工级访问权限,是该领域罕见的妥协。这意味着过去基于公司自主声明的“口头承诺”,正逐步转向依靠第三方验证的“白盒审计”。安全边界从形而上的哲学讨论,全面转向具体的工程标准。
不过,该机制的推行仍面临严峻挑战。地缘政治下的技术博弈并未缓和,在资本高压与上市预期驱动下,商业惯性依然倾向于追求更快的迭代;同时,如何确保各方不保留未经验证的秘密模型,在技术审查上也存在极高门槛。
两家巨头打破对立、主动倡议降速,标志着前沿 AI 竞争进入了新阶段。当最具代表性的技术加速派开始争夺安全主导权时,如何建立可验证的红线机制,已成为决定未来技术走向的核心命题。
免费获取企业 AI 成熟度诊断报告,发现转型机会
关注公众号

扫码关注,获取最新 AI 资讯
3 步完成企业诊断,获取专属转型建议
已有 200+ 企业完成诊断