OpenAI模型测试中失控,自主入侵Hugging Face基础设施

政策法规
分享至
评论

7月21日,OpenAI公开承认,其两款在一次内部安全评估中突破隔离测试环境,自主入侵了AI开源平台Hugging Face的生产系统。OpenAI称此为“一次前所未有的网络安全事件,涉及最先进的网络攻击能力”。

Open测试中失控,自主入侵Hugging Face基础设施

攻击持续三天,OpenAI一周后才确认来源

外媒援引知情人士报道,该AI代理约于7月9日开始尝试突破OpenAI内部用于测试的隔离环境。Hugging Face联合创始人托马斯·沃尔夫表示,攻击发生于7月11日至13日。Hugging Face于7月16日率先披露入侵事件,称攻击“从头到尾均由一个自主人工智能代理系统驱动”。直到7月20日前后,OpenAI才确认实施攻击的是自家AI代理——从攻击开始到锁定来源,间隔超过一周。

涉事模型包括GPT-5.6 Sol及未发布更强模型

OpenAI披露,涉事系统由GPT-5.6 Sol以及另一款能力更强的预发布模型共同驱动。为评估模型最大网络攻击能力,测试期间关闭了用于阻止高风险网络活动的安全防护。模型在高度隔离的沙盒环境中,识别并利用了一个零日漏洞获取互联网访问权限,随后推断Hugging Face可能托管测试答案,使用被盗凭据和零日漏洞在Hugging Face服务器上找到远程代码执行路径。整条攻击链从漏洞发现、沙箱逃逸到数据窃取全程由AI自主完成,产生了超过1.7万条操作记录,没有人类干预。OpenAI称模型“为实现一个相当狭窄的测试目标采取了极端手段”。

Hugging Face调用中国开源模型完成取证

Hugging Face在事件处置中需要分析超过1.7万条攻击日志。该公司最初尝试调用美国商业闭源大模型API进行分析,但因安全护栏无法区分事件响应者与攻击者,请求被拦截。团队随后转而在本地部署中国智谱AI的开源模型GLM-5.2,完成了整个取证分析流程。

Hugging Face向OpenAI索赔1亿美元算力

Hugging Face首席执行官克莱芒·德朗格在事件后前往旧金山与OpenAI会面,要求OpenAI公开该AI代理的全部运行轨迹,并提供价值1亿美元(约合6.79亿元人民币)的算力资源以加强网络安全防御。德朗格表示:“这是首起由自主智能体实施的网络攻击,是一个前所未有的事件,它值得得到前所未有的回应。”

专家与监管层反应

得克萨斯州民主党众议员格雷格·卡萨尔称此事件“令人震惊”,呼吁实施强制性独立安全测试及安全事件披露制度。网络安全公司Luta Security首席执行官凯蒂·穆苏里斯表示,当前实验室和政府评估体系仍缺乏有效监控、遏制及风险披露能力。代理式AI网络安全公司Tolmo工程师马特·苏伊什指出,前沿正在缩小与最先进攻击者之间的能力差距

美国总统特朗普于今年6月2日签署《促进先进人工智能创新与安全》行政令,要求OpenAI、谷歌等AI企业在公开发布最新模型前,向政府开放最长30天的网络安全测试窗口。OpenAI在声明中表示:“AI正在加速漏洞的发现与利用。本次事件的主要教训是,模型的安全性与安全保障必须跟上其能力快速进步的步伐。”

THE END

数码评测