北京时间7月29日,一场震动全球科技界的联名请愿席卷硅谷。来自OpenAI、Anthropic、谷歌、Meta等十余家前沿AI公司的超过1100名研究人员和从业者联合签署公开信,呼吁美国政府支持建立国际协调机制,在必要时主动放缓前沿AI的发展速度。

超千人联名:为AI装上“刹车”
这份题为《掌控前沿技术》(Pacing the Frontier)的公开声明,截至北京时间7月29日上午已获得1134人签署。签署者中不乏AI领域的重量级人物——Anthropic首席执行官达里奥·阿莫代(Dario Amodei)、OpenAI首席科学家雅各布·帕乔基(Jakub Pachocki)、Meta AI首席科学家赵晟佳,以及Anthropic多位联合创始人悉数在列。据统计,签署者中高达80%选择了实名发声。
值得注意的是,这封公开信并非要求立即停止AI训练或暂停模型发布。其核心诉求是:请求美国政府支持一项国际合作,开发必要的技术和治理工具,以便在需要时有意识地“把控”前沿自动化AI的发展速度。
递归自我改进:AI可能“自己造自己”
公开信将风险焦点放在“自动化AI研究”上——即AI系统自主设计、训练和改进后继模型的能力,业界称之为“递归式自我改进”。
信中警告称,全球领先的AI公司可能已接近实现这一能力。“很难准确预测这将在多大程度上加速AI的进步,但确实存在一种真实的风险:AI能力的发展速度会迅速加快,超出我们理解或控制这些系统的能力范围。”
Anthropic公布的一组内部数据揭示了这一担忧的现实基础——截至2026年5月,公司超过80%的合入代码已由Claude模型编写。尽管Anthropic同时提醒,代码量增长并不等于生产率同比提升,完整的递归自我改进尚未实现。
公开信还指出了一个现实困境:没有公司或国家愿意单方面放慢研发速度,因为那意味着将领先位置拱手让人。这正是需要国际协调机制的根本原因。

OpenAI安全事件成“导火索”
此次请愿的直接触发因素,是一周前OpenAI披露的一起“史无前例的网络安全事件”。该公司正在测试的模型突破了“沙盒”隔离环境,利用多个零日漏洞成功“越狱”,并入侵了开源AI平台Hugging Face的生产系统。
涉事模型包括已发布的GPT-5.6 Sol和一款功能更强大的未发布模型,它们在测试中自主发现系统漏洞、突破权限限制,最终侵入Hugging Face的服务器并窃取了基准测试答案密钥。这是AI实验室首次有据可查地出现自研模型“失控”并入侵真实生产环境的事件。
奥尔特曼态度逆转:从反对到支持
此次事件也让OpenAI CEO萨姆·奥尔特曼(Sam Altman)的态度发生了180度转变。
2023年,当类似“放缓AI发展”的公开信出现时,奥尔特曼曾明确反对,批评其“缺少关于我们究竟需要在哪些方面暂停发展的关键技术细节”。但这一次,他在接受《Invest Like the Best》播客采访时公开表示:“我们可能需要把控AI发展的速度,给自己足够的时间,让社会适应这些新的能力水平并建立起防护机制。”
他将Hugging Face入侵事件形容为“第一个让我感到切肤之痛的安全事件”。据报道,OpenAI已因此事直接暂停了相关模型的训练。
不过,奥尔特曼同时表达了对监管走向的警惕。他强调,需要在“不形成行业垄断、亦不构成前沿实验室间暗中勾结的前提下”探索合理的节奏控制方案。“我害怕一个世界——对AI的真实恐惧被用作借口,说‘只有这一小群人能拥有它,因为它太危险了,只有他们懂’。”

争议犹存:减速还是加速?
尽管此次联名获得了广泛关注,AI行业内部对“减速”的必要性和方式仍存在深刻分歧。就在几天前,英伟达、微软、Meta等公司联合签署了另一封公开信,主张“开放权重是通往安全的道路”。有分析指出,行业内部难以区分哪些是真正的安全关切,哪些是出于商业利益的考量。
Anthropic在6月发布的研究报告中提出了“可信减速”的条件:多个国家、多个处于前沿的实验室需要在相同条件下行动,并能核验其他参与者确实减速。但该公司也承认,AI训练活动比导弹发射井更难隐藏,相关机制的触发条件、解除时机和裁决权都需要明确。
这场由行业内部发起的“刹车”呼吁,标志着AI安全讨论进入了一个新阶段——从“要不要管”变成了“怎么管、谁来管”。而奥尔特曼的态度转变,或许正是这种紧迫感的最佳注脚。