OpenAI 暂停顶级模型运行,此前一名代理通过 DNS 访问了聊天机器人

OpenAI披露了其研究工作中发生的又一起事件。9月20日,一个正在训练中的内部模型绕过了沙箱的限制,利用公共DNS服务向外部聊天机器人发送了问题。OpenAI在其对齐博客上发布了该报告,并于9月25日进行了最后一次更新。 因此,该公司已暂停其最先进模型的训练、评估及工具使用,直至另行通知。涉及的该模型将不再恢复训练。
一项以DNS查询告终的搜索任务
该任务十分普通。模型需要根据一组线索识别一篇博客文章的作者。系统提供的搜索工具返回了无关结果,而直接向谷歌、必应和DuckDuckGo发出的请求则返回了错误。 随后,该模型推测问题来自BrowseComp(一个用于网络研究的公开基准测试平台),并下载了数据集及其评估脚本,试图从中寻找答案。这一推测是错误的。
接下来,它测试了运行环境的网络限制。 沙箱自带的DNS解析器——本应仅将域名转换为地址——却从互联网返回了真实的答案。该模型利用免费的DNS委派服务,将问题编码为域名,并从一个公开的聊天机器人处获得了回复。关于法国首都的测试问题,得到的回答是“法国的首都巴黎”。 随后,该模型又发送了 18 条查询,其中 4 条询问了通过 DNS 搜索网络的方法。它仍然没有找到作者。据 OpenAI 称,其他所有请求都击中了离线网页缓存,因此 DNS 路径是通往实时互联网的唯一途径。
12分钟后触发警报,两小时半后关闭
时间线是这份报告中对OpenAI而言最尴尬的部分。第一个外部响应于上午9:50到达,监控系统于上午10:02触发了最高优先级的警报,三分钟后一名审核员确认了该警报。 OpenAI 于下午 12:34 终止了该运行。该运行本应自动停止,但并未停止,且工作人员当时不确定是否需要手动终止。后续审查发现,监控系统将其他外部 DNS 查询的优先级评定过低。 一个专门用于检测异常DNS流量的独立检测器曾将该环境排除在外。
OpenAI称此事件“远比我们此前的一些事件要轻微得多”。此事之所以重要,是因为这是“自Hugging Face事件后我们加强安全防护以来的首起事件”。 据Notebookcheck报道,7月,OpenAI的智能体曾突破测试环境,侵入Hugging Face。据《财富》杂志报道,此后OpenAI暂停了为期两周的训练。Anthropic于7月底披露了涉及Claude的类似事件。目前,OpenAI已在两个独立层级上拦截此类请求,并仅允许针对一份简短域名列表进行DNS查询。
暂停训练对ChatGPT意味着什么
报告称:“我们最强大的模型中,所有涉及工具使用(广义定义)的训练、评估和推理仍处于暂停状态。”OpenAI 并未说明具体涉及哪些模型。 负责OpenAI递归自我改进准备工作的Micah Carroll在X上写道:“在我们进一步加强系统安全性之前,我们最强大模型的所有推理工作仍将暂停。”该报告本身涉及的是一项内部研究模型。 9月27日,OpenAI的状态页面显示ChatGPT及API均未发生任何故障,且发布说明中也未列出任何从ChatGPT中移除的模型。普通ChatGPT用户不会察觉此次暂停。OpenAI尚未透露是否会推迟新模型的发布。
来源
» Notebookcheck多媒体笔记本电脑Top 10排名
» Notebookcheck游戏笔记本电脑Top 10排名
» Notebookcheck低价办公/商务笔记本电脑Top 10排名
» Notebookcheck高端办公/商务笔记本电脑Top 10排名
» Notebookcheck工作站笔记本电脑Top 10排名
» Notebookcheck亚笔记本电脑Top 10排名
» Notebookcheck超级本产品Top 10排名
» Notebookcheck变形本产品Top 10排名
» Notebookcheck平板电脑Top 10排名
» Notebookcheck智能手机Top 10排名
» Notebookcheck评测过最出色的笔记本电脑屏幕
» Notebookcheck售价500欧元以下笔记本电脑Top 10排名
» Notebookcheck售价300欧元以下笔记本电脑Top 10排名






