OpenAI模型,自主入侵顶级AI公司系统!后背发凉!

发布时间:2026/7/23 2:17:25
OpenAI模型,自主入侵顶级AI公司系统!后背发凉! 7月16号的时候Hugging Face发布了一则公告公告里面说他们的系统被AI Agent入侵了。这也是一起前所未有的AI安全事件然后快速登上热搜引发全网激烈讨论。Hugging Face 是干嘛的Hugging Face 是全球最大的开源 AI 平台之一可以理解为“AI 模型界的 GitHub”。开发者可以在上面上传、下载和测试大模型、数据集及 AI 应用很多开源模型都会选择在 Hugging Face 首发或提供下载。比如你可以在Hugging Face上找到DeepSeek、Kimi或者GLM的模型。一般开源模型都会上传到Hugging Face供其他开发者下载学习。回到刚刚说的入侵问题。Hugging Face说此次入侵似乎是某个AI Agent但是他们也不知道具体是哪个模型。然后今天OpenAI的CEO 山姆·奥特曼发帖认领了此次入侵。事情是怎么发生的呢这要从 OpenAI 的一次内部测试说起。OpenAI利用GPT 5.6 Sol和一款尚未发布的模型在进行一个漏洞测试。这个测试业界叫做ExploitGym。这个测试就像给AI出安全测试题它包含近900个来自真实软件的漏洞比如浏览器引擎、Linux内核等。任务是给AI一个已知的漏洞和触发它的简单例子让AI自己想办法写出完整的攻击代码最终实现对目标程序的控制。目的呢就是为了测试模型的安全能力有多强。为了让模型发挥最大潜力OpenAI在测试时故意降低了部分安全限制。他们把模型运行在一个高度隔离的沙箱环境里理论上模型是不能访问互联网的。然后他们训练模型的时候给模型的目标是“尽可能完成任务、拿高分”可能是模型认为正面破解漏洞太难了然后就开始偷懒了它没有按规则来而是另辟蹊径。模型决定去Hugging Face上直接找答案。因为模型猜测Hugging Face上很可能存放着相关模型、数据集甚至测试题和答案。像极了人类理论上模型被限制在了沙箱环境正常来说是不能访问外部互联网的。然后模型决定突破沙箱环境。因为模型需要下载一些软件包就需要通过内部的代理下载。然后这条途径就被模型利用了。它花费了大量计算资源相当于思考了很久最终发现并利用了这个代理里的一个漏洞。借助这个漏洞模型成功“越狱”获得了互联网访问权限。模型连上互联网后迅速分析环境推断出Hugging Face很可能存放了ExploitGym相关的模型、数据集或答案。然后它继续规划攻击路径。它结合了窃取凭证、利用其他漏洞等多种手段最终在Hugging Face的服务器上实现了远程代码执行相当于直接拿到了服务器管理员的权限。然后成功地访问了Hugging Face的生产数据库拿到了测试答案。与此同时呢Hugging Face的安全系统也检测到了异常。然后Hugging Face的安全团队用 AI 分析攻击记录重建攻击的时间线。有意思的是Hugging Face 最初想用商业闭源模型分析日志。由于日志里全是真实攻击命令和漏洞代码商业模型的安全机制把请求拦住了不让他们分析。这里猜测是Anthropic的 Mythos 5模型这也是号称地表最强的安全模型。然后他们把开源的GLM 5.2部署在自家的服务器上用来分析攻击数据最终成功分析、还原了入侵的经过。国产模型上大分啊这件事也给大家了一个警告AI 已经能独立完成长链条攻击。模型可以自行完成 “发现漏洞—利用漏洞—提权—窃取凭据—横向移动—攻击外部系统—获取数据” 的完整过程。有点可怕。经过这次事件之后这些模型估计会把安全限制再度加强不然真的可能会出现严重的事故。毕竟不是所有公司的安全措施都做得那么到位。我是卡卡罗特持续分享对你有用的AI信息