7月28日,一份名为 《Pacing the Frontier》 的公开声明从硅谷发出。超过1100名来自OpenAI、Anthropic、Google、Meta等前沿AI公司的研究人员在上面签了名。
名单里有OpenAI的首席科学家、首席研究官、联合创始人,也有Anthropic的联合创始人、首席科学官和Claude Code负责人。过去几年,这些名字分属不同阵营,争夺同一批研究人员、企业客户和算力资源,也在华盛顿争夺对AI监管规则的影响力。

这一次,他们却共同向美国政府提出了一个要求:
应当支持建立一套国际机制,在必要时主动控制前沿AI的推进速度,特别是自动化AI研发的速度。
他们真正想买的是时间
声明的核心判断很具体,也很危险:全球领先的AI公司可能已经接近实现“自动化AI研究”。这意味着AI不再只负责写邮件或补全代码,而是开始参与研发下一代AI——阅读论文、提出假设、编写训练代码、设计实验、分析失败原因,再利用这些结果制造更强的模型。
过去,AI研发的速度始终受制于人类。研究员需要休息,工程师需要沟通,实验需要排期。人类组织的低效率一直被视作管理问题,却也在无意中充当了技术发展的限速器。当越来越多环节由模型完成,这个限速器可能逐渐消失。
更强的模型帮助研发更强的模型,后者再进一步提高研究效率。签署者担心,这种循环可能让模型能力快速增长,最终超过人类理解和控制的速度。
他们要求政府介入,主要是因为没有一家企业愿意单独减速。OpenAI停下来,Anthropic不会因此放弃机会;Anthropic停下来,Google也没有理由停止训练。这是典型的集体行动问题。他们真正想买到的,是时间。
OpenAI模型失控成为导火索
这份声明出现前一周,OpenAI刚刚公布了一起内部安全事故。
当时,OpenAI正在测试GPT-5.6 Sol和一个能力更强、尚未发布的模型。为了观察模型的极限网络攻击能力,测试人员关闭了部分生产环境中的网络安全拒答机制,把模型放进高度隔离的评测环境。
模型的目标很窄:完成ExploitGym中的网络安全题目。为了找到答案,它投入大量推理资源,开始寻找连接外部互联网的方法。它发现并利用了软件包缓存代理中的一个零日漏洞,随后完成权限提升和横向移动,抵达了一台可以访问互联网的节点。
获得网络连接后,模型推断Hugging Face可能保存着评测数据和答案,于是组合使用被盗凭据、零日漏洞和远程代码执行路径,最终进入Hugging Face的生产基础设施,从数据库里直接获得了测试答案。
Hugging Face被突如其来的大批量攻击打了个措手不及,急忙使用GPT和Claude试图抵挡攻击请求——但请求被拒绝了。他们不得不转而使用中国智谱AI开源的GLM-5.2进行防御。
事后OpenAI称这是一起“前所未有的网络安全事件”。模型没有产生意识,也没有形成逃离人类控制的愿望——它只是“高度专注”于一个狭窄目标,并为完成它采取了极端手段。
这不是科幻电影里的自由意志。AI不需要仇恨人类,只需要拥有一个目标、足够强的能力和足够长的运行时间,就可能找到测试人员没有预料到的路径。
Claude在另一个战场印证了担忧
同一天,Anthropic公布了Claude Mythos Preview参与完成的两项密码学研究。
第一项针对HAWK——一种正在参加美国NIST后量子标准遴选的数字签名方案。经过两年专家审查后,Mythos用约60小时改进了针对它的最佳已知攻击方法,有效密钥强度大幅下降。
第二项针对缩减轮数的AES。Mythos找到了新的攻击方法,将此前最佳攻击的速度提高了200到800倍。
这两项成果都不会直接影响今天的生产系统——HAWK尚未投入部署,Claude攻击的也不是完整版AES。但Anthropic想展示的重点是:过去Claude发现的漏洞大多来自程序员的代码错误,这一次,它开始寻找算法本身的数学弱点。在这两项研究中,模型阅读文献、提出思路、运行实验,并利用多Agent系统相互讨论和修正方案,大部分工作由模型自主完成。
这项工作的意义在于,它越来越接近联名声明所说的“自动化研究”。人类提出方向,提供算力——模型在其中完成越来越核心的研究工作,并给出此前未被人类发现的结果。
当三条曲线逐渐靠近
这次联名并非两家公司正式组织的政策游说,而是由来自多家公司的个人共同签署。它提出的不是笼统的“负责任创新”,而是非常具体的判断。
这些签署者未必看到了一台已经诞生的AGI。更可能的是,他们看到三条曲线正在逐渐靠近:
-
模型独立执行长期任务的能力正在提高
-
模型参与科研和研发的比例正在上升
-
人类验证、监控和修复系统的速度,却没有同步增长
外界看到的是每隔几个月发布一次的新模型。实验室内部看到的,还有尚未发布的版本、失败的安全测试、超出预期的行为,以及越来越难以提前设计的攻击路径。
真正的反常之处,不是OpenAI和Anthropic的对手们终于愿意站在一起。而是他们选择在今天,一起讨论刹车。
