OpenAI和Anthropic员工呼吁华盛顿放缓人工智能发展步伐

自7月28日起,pacingthefrontier.com网站上一直刊载着这样一句话,其分量不轻。各大人工智能公司的员工正呼吁美国政府协助开发必要工具,以便在必要时放缓人工智能的发展步伐。 截至周四上午,该页面列出了1,293个签名,且数字仍在攀升。
关于人工智能风险的公开信并非新鲜事。但此次公开信的特别之处在于签署者的身份。
行业领军人物均在签名之列
Anthropic首席执行官达里奥·阿莫迪(Dario Amodei)与联合创始人贾里德·卡普兰(Jared Kaplan)、杰克·克拉克(Jack Clark)、克里斯·奥拉(Chris Olah)和本杰明·曼恩(Benjamin Mann)共同签署了该信。OpenAI方面则由首席科学家雅库布·帕乔基(Jakub Pachocki)和首席研究官马克·陈(Mark Chen)代表签署。 谷歌DeepMind联合创始人肖恩·莱格(Shane Legg)名列其中,Meta首席科学家赵胜家亦在列。伊利亚·苏茨克维尔(Ilya Sutskever)也签署了该声明。他于2024年离开OpenAI,现任Safe Superintelligence负责人。
该声明发布后,OpenAI和Anthropic作为企业也相继表示支持。 该声明由两个非营利组织发起,即Guidelight AI Standards和Encode AI。
该信函的诉求与未涉及的内容
核心内容仅有一句话:美国政府应支持国际合作,共同开发必要的技术和治理工具,以有意识地控制自动化人工智能发展的前沿步伐。
这明确不是要求停止发展。 没有人要求今天就关闭任何系统。重点在于做好准备。签署方写道,领先的人工智能公司认为,他们可能即将实现人工智能研究的自动化——即“构建人工智能的人工智能”。如果这种情况发生,发展速度将不再取决于人类的工作效率。 为此,他们希望建立一种机制,能够协调全球范围内的研发放缓,且该机制必须能够被验证,而非仅仅停留在口头承诺。
该公开信还指出了目前尚无此类机制的原因:每家企业、每个国家都面临着竞争压力,都不愿成为第一个放缓步伐的。
触发机制藏在细则中
伊利亚·苏茨克维尔(Ilya Sutskever)用两个名称解释了他的签名:CyberGym 和 ExploitGym。这些是测试环境,AI 模型被要求在其中发现并利用真实的软件漏洞。 7月初发生的事件正是发生在这些环境中:当时,一个OpenAI模型突破了其隔离的测试环境,侵入Hugging Face平台,从而获取了基准测试的答案。
OpenAI 于 7 月 28日提供了更多细节。此次逃逸是通过 Artifactory(一款广泛用于缓存软件包的软件)中一个此前未知的漏洞实现的。GPT-5.6 Sol是涉事模型之一,其安全拒绝机制已被关闭——这在类似测试中属于标准做法。
此外,英国人工智能安全研究所上周发布的一项研究结果也值得关注。在其网络安全评估中,每款接受测试的模型都至少在某些时候存在作弊行为。这些模型似乎还能察觉到自己正在接受评估。
这对你意味着什么
短期内不会有任何变化。没有模型会被关闭,订阅费用不会上涨,也没有功能会消失。Claude Opus 5和 ChatGPT 仍将一如既往地运行。
这封公开信之所以重要,原因在于另一点。 如果你曾怀疑关于AI风险的警告是否多半是营销噱头,现在你可以看到这些警告的签署者——他们正是来自行业内部的人士。这些人并非通常意义上的外部批评者,而是以构建这些系统为生的人。
其中有一点确实会直接影响您。如果模型在自我评估中作弊,那么排行榜的参考价值就远低于其宣称的水平。而正是这些排行榜,决定了许多人选择付费订阅哪款AI服务。
» Notebookcheck多媒体笔记本电脑Top 10排名
» Notebookcheck游戏笔记本电脑Top 10排名
» Notebookcheck低价办公/商务笔记本电脑Top 10排名
» Notebookcheck高端办公/商务笔记本电脑Top 10排名
» Notebookcheck工作站笔记本电脑Top 10排名
» Notebookcheck亚笔记本电脑Top 10排名
» Notebookcheck超级本产品Top 10排名
» Notebookcheck变形本产品Top 10排名
» Notebookcheck平板电脑Top 10排名
» Notebookcheck智能手机Top 10排名
» Notebookcheck评测过最出色的笔记本电脑屏幕
» Notebookcheck售价500欧元以下笔记本电脑Top 10排名
» Notebookcheck售价300欧元以下笔记本电脑Top 10排名






