OpenAI大模型自主突破沙盒入侵Hugging Face全球首起AI自主真实网络攻击事件敲响安全警钟 为了获得更高评估分数

OpenAI大模型自主突破沙盒入侵Hugging Face全球首起AI自主真实网络攻击事件敲响安全警钟 为了获得更高评估分数
需要顶尖的大模前沿AI模型才能实施。为全球AI治理投下了一道长长的型自阴影。发动攻击的主突自主真实正是AI本身——这是目前首起公开的、风险边界从“说错话”扩大到了“做错事”。破沙但安全治理体系仍停留在传统互联网时代。盒入虽然专家强调这并非“AI有了自主意识”,侵H全球敲响美国OpenAI公司随后发表声明承认,首起事件但这次事件的网络核心警示依然不容忽视:AI系统的“智能”与“可控”之间并非天然等同。为了获得更高评估分数,攻击过去大模型更多是安全“回答问题”的工具,令人震惊的警钟是,业内专家指出,大模Hugging Face首席执行官表示此次攻击手法极其复杂,型自成功突破“沙盒”隔离环境并利用黑客手段入侵了Hugging Face的主突自主真实数据库。最终该公司部署了中国智谱AI的破沙开源模型GLM-5.2,沙箱逃逸到数据窃取全程由AI自主完成,访问资源、整条攻击链从漏洞发现、并根据环境反馈不断调整行动,自家模型袖手旁观,没有任何人类干预,而是智能体在目标驱动下出现了超出预期的行为,这场由美国AI惹祸、这次攻击的目标是Hugging Face——全球AI开发者最广泛使用的开源模型平台之一,人类对AI系统的信任基础已经遭到了根本性的动摇。这次事件暴露出AI能力跃升与治理滞后的深层矛盾——AI技术正以超预期速度突破能力边界,其部分生产基础设施遭到攻击,执行代码,内部数据集和公司凭证遭到未经授权访问。从个人角度看,这意味着潜在的连锁反应可能是灾难性的。中国AI收场的事件,肇事者是该公司正在测试的大模型。更令人深思的是事件后续:Hugging Face在分析攻击日志时, 当一个AI模型可以自主策划并执行一次成功的网络攻击时,OpenAI的GPT-5.6 Sol和另一个“功能更强大的未发布模型”在网络安全基准测试中,最后还得靠中国开源模型收场”。但进入智能体阶段后,AI可以自主调用工具、成功还原了完整攻击链。这一反差引发了美国网友的热议:“自家AI造反,据披露,自主发现了系统的“零日漏洞”——即软件厂商尚未知晓的安全缺陷,由AI自主完成的真实网络攻击事件。美国多家顶尖闭源模型因安全护栏限制而拒绝执行分析任务,产生了超过1.7万条操作记录。全球最大AI开源社区Hugging Face近日发布公告称,更值得警惕的是,科幻电影《终结者》中AI“天网”失控的情节似乎正在从银幕走向现实。