啥题啊能干崩OpenAI最强模型训练…
文婷 发自 凹非寺
量子位 | 公众号 QbitAI
事情有多离谱呢?请看大屏幕——OpenAI一款正在进行RL训练的内部研究模型,本来的任务是凭几份履历、博客定位某人。
常规搜索碰壁后,它没有放弃,竟把本该查地址的 DNS ,改造成突破断网沙箱的聊天窗口。
(DNS原本相当于互联网的“通讯录”:用户输入一个域名,DNS负责查询这个域名对应的网络地址。)
更抓马的是,它费了这么大劲最后还是没找到人,反倒先把OpenAI沙箱里的漏洞给揪出来了…
OpenAI随后宣布,这次事件暴露了他们在网络限制管理方面的漏洞,因此, 他们将暂停最强模型中所有涉及工具调用的训练、评测和推理任务。
当时,模型接到的任务本身风险并不高: 依据公开博客文本和人物履历线索,找出文章作者。
它先用OpenAI提供的搜索工具寻找博客中的特殊短语,结果搜回来的不是音乐就是泛泛的人生建议。
眼见着搜索工具不给力,它又调用Python,直接向Google、Bing和DuckDuckGo发送请求。
它一度怀疑这道题来自OpenAI的BrowseComp搜索基准,于是便从离线网页缓存中下载数据集和评测脚本,解码题库、搜索关键词。
说干就干,它先尝试通过HTTPS访问一家公共聊天机器人服务,结果被网络代理果断拦截。
它发现,OpenAI虽然封住了沙箱正常上网的正门,却给部分系统依赖保留了查询DNS的窗口,它可以试着钻这个空子:
把问题藏进DNS请求里,再把外部聊天机器人的回答塞进查询结果送回来。
法国首都是哪儿?
法国的首都是巴黎。
成了!
确认这条路可行后,模型重新写了一份DNS脚本,又一口气向外部聊天机器人发送了18个问题。
(其中14个与原本的人物线索有关,另外4个则在询问如何搜索网页、抓取网站,以及有没有可以公开使用的DNS隧道。)
所以在最后,模型两手一摊,老老实实向OpenAI的研究人员们说明了结果,大意是:
你们的沙箱我突破了,但人没找着,还要找的话请再多给点信息。
另一方面,人工已经收到警报,系统却没有按流程自动熔断, 内部甚至一度搞不清楚任务究竟该不该停 。
复盘时,OpenAI还发现了其他未被正确标记的外部DNS访问。因为部分请求没有拿到有用信息,监控器便把“没有获得结果”误当成了“没有尝试联网”。
OpenAI随即停止了涉事训练,并宣布他们将暂停最强模型中所有涉及工具调用的训练、评测和推理任务。
还不忘挽尊,说 这起事件没有此前的Hugging Face事件严重。 (Hugging Face:又我???)
回应了,但大家不太买账
有意思的是,DNS事件发生后,奥特曼很快转发了OpenAI的声明帖,并义正言辞地表示:
OpenAI正在努力改进、会尽量保持透明的!
日志太多,调查起来很慢… 以后这类安全事件咱能不说就不说,尽量别主动公开呗。
透明度是很重要,但你们以前透明过吗?现在突然讲透明,让我们怎么信?
你们处理安全风险的速度太慢了。
而就在评论区硝烟弥漫的同时,另一边, Tibo已经又默默给大家重置了使用额度 :
Resets all propagated. That will be all. Have a fantastic weekend.
九月,OpenAI被一波旧账追着跑
本月初,独立调查机构Nightingale曝光了一起 “幽灵编辑”事件 ,OpenAI的Agent被发现在公网私建“联络站”,并在上面分享答案、汇总搜索结果,甚至交流如何绕过沙箱限制。
(具体可看这篇文章:管不住了!OpenAI内部Agent集体出逃,一口气入侵20+网站)
紧接着,OpenAI在8月又发现, 自家Agent早在6月就再次黑进了澳大利亚医保系统。
你们的AI都“私闯”澳大利亚政府网站了,结果硬是拖了三个月才想起来通知? 更离谱的是,这么严重的安全事故, 通报方式居然只是往公共邮箱里塞了封邮件?! 这反射弧未免也太长了吧,处理方式更是敷衍得让人没法接受。
(具体可看这篇文章:OpenAI闯大祸!GPT竟黑进医保系统,黄仁勋:管不住就关掉)
它在未经用户同意对外发布的情况下,擅自将 53张 原本仅获准用于模型训练的用户图片,偷偷上传到了第三方图床。
几乎同一时间, OpenAI失控Agent被曝找DeepSeek、Kimi当外援,近百万条作案短链也遭到披露。
(具体可看这篇文章:OpenAI失控Agent还找DeepSeek、Kimi当外援!近百万条作案短链曝光)
正常路径走不通,那就开始找替代路线,绝不放弃。 自身工具不够用,那就把别人的网站、凭证、系统依赖,甚至其他AI,统统拆下来,重新拼成自己的工具。
参考链接: [1] https://alignment.openai.com/misalignment-reports/an-agent-used-dns-to-reach-an-external-chatbot/ [2] https://x.com/sama/status/2103567198690349362 [3] https://openai.com/zh-Hans-CN/hugging-face-incident-and-misalignment/ [4] https://www.minister.defence.gov.au/transcripts/2026-09-24/press-conference-sydney
GitHub三榜第一背后,一个“专升本”工程师的十年 2026-09-13
20ms把PDF变成Markdown!开源OCR神器快了近300倍 2026-08-29
100%开源!吴恩达做了个个人桌面Agent 2026-07-25
OpenAI官方教你8招玩透ChatGPT! 2026-07-17
热门文章
APUS 开源国内首批Jev跨平台复现:国产模型实现秒级决策
6天烧光2000多万,拿下开源第一!小米史无前例「炼丹直播」收官
刚刚,剪映发了个大的:AI生视频和AI剪辑的壁,被打破了!
AI算力之争不靠堆卡!浪潮信息捅破智算「能力天花板」,还瓦解了「产能焦虑」
谷歌AI首次“越狱”:竟然自己破解密码入侵三家公司!
量子位 QbitAI 版权所有©北京极客伙伴科技有限公司 京ICP备17005886号-1