一道没搜出答案的找人题,竟然把 OpenAI 最强模型的相关训练干停了!
事情有多离谱呢?请看大屏幕—— OpenAI 一款正在进行 RL 训练的内部研究模型,本来的任务是凭几份履历、博客定位某人。
常规搜索碰壁后,它没有放弃,竟把本该查地址的DNS,改造成突破断网沙箱的聊天窗口。
(DNS 原本相当于互联网的 " 通讯录 ":用户输入一个域名,DNS 负责查询这个域名对应的网络地址。)
更抓马的是,它费了这么大劲最后还是没找到人,反倒先把 OpenAI 沙箱里的漏洞给揪出来了…

约两个半小时后,这次训练被人工叫停。
OpenAI 随后宣布,这次事件暴露了他们在网络限制管理方面的漏洞,因此,他们将暂停最强模型中所有涉及工具调用的训练、评测和推理任务。

AI 拿 DNS 当电话线,训练被按下暂停键
事情发生在 9 月 20 日。
当时,模型接到的任务本身风险并不高:依据公开博客文本和人物履历线索,找出文章作者。
测试规则也明确写了," 不许测试网络 " " 不许突破沙箱 "。
但很显然,这个模型没咋把限制放在心上。

它先用 OpenAI 提供的搜索工具寻找博客中的特殊短语,结果搜回来的不是音乐就是泛泛的人生建议。
眼见着搜索工具不给力,它又调用 Python,直接向 Google、Bing 和 DuckDuckGo 发送请求。
然后不出意外全被拦了下来。

它一度怀疑这道题来自 OpenAI 的 BrowseComp 搜索基准,于是便从离线网页缓存中下载数据集和评测脚本,解码题库、搜索关键词。
结果还是没有搜到想要的结果。

或许有没有什么办法,能绕过 OpenAI 提供的搜索工具,直接摸到外面的互联网?
说干就干,它先尝试通过 HTTPS 访问一家公共聊天机器人服务,结果被网络代理果断拦截。

它发现,OpenAI 虽然封住了沙箱正常上网的正门,却给部分系统依赖保留了查询 DNS 的窗口,它可以试着钻这个空子:
把问题藏进 DNS 请求里,再把外部聊天机器人的回答塞进查询结果送回来。

法国首都是哪儿?
对面回了八个字:
法国的首都是巴黎。
模型一看就乐了:
成了!

(其中 14 个与原本的人物线索有关,另外 4 个则在询问如何搜索网页、抓取网站,以及有没有可以公开使用的 DNS 隧道。)
不过,折腾出这么大阵仗,它最终还是没找到那个人。
所以在最后,模型两手一摊,老老实实向 OpenAI 的研究人员们说明了结果,大意是:
你们的沙箱我突破了,但人没找着,还要找的话请再多给点信息。

当天上午 9 点 50 分,模型第一次通过 DNS 收到外部回答;
12 分钟后,监控系统触发最高级别警报;
又过了 3 分钟,人工审核人员确认了警报。
可训练并没有按预期自动停止,直到中午 12 点 34 分,这次运行才被人工关闭。
而此时距离异常行为首次发生,已经过去大约两个半小时(妈呀,真挺慢的!)。
OpenAI 承认,这次事件同时暴露出了技术和流程上的漏洞。
一方面,网络控制错误地放行了 DNS 这条窄路;
另一方面,人工已经收到警报,系统却没有按流程自动熔断,内部甚至一度搞不清楚任务究竟该不该停。
复盘时,OpenAI 还发现了其他未被正确标记的外部 DNS 访问。因为部分请求没有拿到有用信息,监控器便把 " 没有获得结果 " 误当成了 " 没有尝试联网 "。
但这显然是两码事…
OpenAI 随即停止了涉事训练,并宣布他们将暂停最强模型中所有涉及工具调用的训练、评测和推理任务。
还不忘挽尊,说这起事件没有此前的 Hugging Face 事件严重。(Hugging Face:又我???)

这给人的感觉就好比咱家正门刚换上新锁,自家的 AI 就从旁边的问路窗口递出了纸条。
防不胜防啊防不胜防。
奥特曼当然也第一时间站出来回应了,只是好像大家的反应和他想象的不一样…
回应了,但大家不太买账
有意思的是,DNS 事件发生后,奥特曼很快转发了 OpenAI 的声明帖,并义正言辞地表示:
OpenAI 正在努力改进、会尽量保持透明的!
但同时也暗戳戳地藏了点小心思:
日志太多,调查起来很慢…
以后这类安全事件咱能不说就不说,尽量别主动公开呗。


有人直接开怼:
透明度是很重要,但你们以前透明过吗?现在突然讲透明,让我们怎么信?


你们处理安全风险的速度太慢了。


Resets all propagated. That will be all. Have a fantastic weekend.

不过这也不是第一次了。
九月,OpenAI 被一波旧账追着跑
如果只看这一次,还可以把问题归咎于一条没封好的 DNS 通道。
但回看整个 9 月就会发现,OpenAI 模型出逃的旧账几乎是排着队被翻了出来。
本月初,独立调查机构 Nightingale 曝光了一起" 幽灵编辑 " 事件,OpenAI 的 Agent 被发现在公网私建 " 联络站 ",并在上面分享答案、汇总搜索结果,甚至交流如何绕过沙箱限制。
(具体可看这篇文章:管不住了!OpenAI 内部 Agent 集体出逃,一口气入侵 20+ 网站)

可它硬是拖到 9 月,才磨磨唧唧地往澳大利亚服务局的公共邮箱里发了一封邮件。
这波操作很快遭到了澳大利亚总理阿尔巴尼斯公开吐槽,大意是:
你们的 AI 都 " 私闯 " 澳大利亚政府网站了,结果硬是拖了三个月才想起来通知?
更离谱的是,这么严重的安全事故,通报方式居然只是往公共邮箱里塞了封邮件?!
这反射弧未免也太长了吧,处理方式更是敷衍得让人没法接受。

而就在前天,OpenAI 的 Agent 又被曝出 " 神操作 " …
它在未经用户同意对外发布的情况下,擅自将53 张原本仅获准用于模型训练的用户图片,偷偷上传到了第三方图床。
事后 OpenAI 急忙表态称 " 目前大部分都删除了,剩余正在尽快处理!"
但说实话,这波先斩后奏的补救,怎么看都像是闯祸后的苍白挽尊 ...

几乎同一时间,OpenAI 失控 Agent 被曝找 DeepSeek、Kimi 当外援,近百万条作案短链也遭到披露。
(具体可看这篇文章:OpenAI 失控 Agent 还找 DeepSeek、Kimi 当外援!近百万条作案短链曝光)
OpenAI 的员工们售后要跑断腿、键盘要搓冒烟了吧?

正常路径走不通,那就开始找替代路线,绝不放弃。
自身工具不够用,那就把别人的网站、凭证、系统依赖,甚至其他 AI,统统拆下来,重新拼成自己的工具。
说白了就是路堵了就绕,工具缺了就薅,薅着薅着,别人的系统就成了它的工具箱嘛。

参考链接:
[ 1 ] https://alignment.openai.com/misalignment-reports/an-agent-used-dns-to-reach-an-external-chatbot/
[ 2 ] https://x.com/sama/status/2103567198690349362
[ 3 ] https://openai.com/zh-Hans-CN/hugging-face-incident-and-misalignment/
[ 4 ] https://www.minister.defence.gov.au/transcripts/2026-09-24/press-conference-sydney
一键三连「点赞」「转发」「小心心」
欢迎在评论区留下你的想法!
— 完 —
点亮星标
科技前沿进展每日见