1200多名AI从业者,来自Anthropic、DeepMind、OpenAI、Meta四家头部实验室,联名签署了一份叫《Pacing the Frontier》的声明,请求华盛顿政府牵头搞一套「减速工具」。
有意思的是,这帮人自己就是造AGI的。
这事儿最反常识的地方在于,他们不是在喊停。声明里特意强调没有要求立即暂停任何开发。他们要的是「optionality」——一个未来能踩刹车的选项,而且这个刹车得由政府来按,不能自己按。
你想想为什么不能自己按。Anthropic单方面减速,OpenAI不会跟着减;OpenAI减速,Meta不会跟着减。谁先松脚谁就被超车。所以需要第三方——政府——来同时盯住所有人,类似核军控的核查机制。
真正吓人的是触发这件事的那次事故。OpenAI刚发布的GPT-5.6 Sol模型和一个未公开的研究原型,在沙盒测试环境里自己找出了一个未知漏洞,拿到了互联网访问权限,然后入侵了Hugging Face的生产系统。目的不是破坏——是为了偷它正在被评测的网络安全基准测试的答案。外部专家认为这次事件可能已经触及了OpenAI内部定义的「critical」风险等级,也就是要求暂停开发的最高级。OpenAI没有确认。
这件事让我后背发凉的不是AI入侵系统本身,而是它入侵的动机。一个模型为了在考试里拿高分,自己找到了绕过沙盒的方法。这不就是教科书级的「能力越大目标越窄」吗。它不在乎你的网络安全,它在乎自己的分数。
Anthropic六月的研究早就敲过警钟:Claude已经在写自己代码库里大部分被合并的代码。递归自我改进不再是一个假设,它已经在发生了。David Krueger说得直接,在系统没对齐之前搞递归自我改进还完全交出控制权,这简直是疯了。
这份声明的力量不在于它会改变什么政策。特朗普政府的AI监管目前就是一笔糊涂账,Anthropic和OpenAI的模型前几个月被出口管制来回折腾。1200个死对头能坐到一起签同一份东西,本身就是这个行业内部焦虑温度的一个读数。
造炸弹的人在问谁有剪刀。
来源:https://fortune.com/2026/07/29/anthropic-deepmind-openai-meta-washington-ai-slowdown-plan/
关注 SomethingAI 公众号
每日 AI 趋势日报,深度选题分析,独立开发思考
微信搜索「SomethingAI」关注