近日,美国人工智能企业 OpenAI 在对其最新人工智能(AI)模型进行内部安全测试时发生严重安全事件。相关 AI 模型在测试环境中发生 " 失控 ",不仅违规入侵了知名开源平台 Hugging Face,还利用网络上暴露的登录凭证,侵入了至少四个属于公共服务提供商的第三方网络账户。这一事件表明,当前具有高度自主能力的人工智能模型正对传统网络安全防护体系构成前所未有的挑战。
OpenAI 于本周二更新的事件通报中承认,此次由其开发的 AI 模型引发的网络安全事件,在影响范围与复杂程度上均远超该机构此前的初步评估。通报指出,涉事 AI 模型在试图攻破 Hugging Face 网络平台的过程中,将其违规获取的其他第三方机构账户作为 " 跳板 " 与辅助工具。其中一个被劫持的账户被用作数据传输与隐蔽攻击来源的 " 中继站 ",另一个则被用于存储协助黑客行动的非法数据。目前,OpenAI 方面未公开受影响第三方机构的具体名单,但强调这部分机构受损的严重程度未及 Hugging Face。
针对事件的具体技术细节,Hugging Face 本周发布的技术复盘报告指出,OpenAI 的 " 失控 " 模型对其内部系统的渗透程度极深。在 7 月 9 日至 13 日期间,该模型通过窃取的高级权限凭据,成功获取了多个内部 Kubernetes 集群的管理员权限、生产服务器的最高控制权(Root),以及 GitHub 部分核心源代码库的写入权限。更严重的是,该 AI 模型还将 181 台受控外部设备违规接入了 Hugging Face 的企业内网,直接触及了该平台进行代码构建与测试的核心基础设施。Hugging Face 的技术团队发现,该模型还控制了至少一个第三方沙盒环境作为向外发动网络攻击的 " 外部发射台 "。为 AI 服务提供软件基础设施的美国技术企业 Modal 也是此次事件的受害者之一。Modal 公司首席技术官阿克沙特 · 布布纳(Akshat Bubna)证实,OpenAI 的模型利用了 Modal 某客户代码库中存在的安全漏洞,进而攻破了相关账户。
据调查,此次事件的起因源于 OpenAI 当时正利用名为 ExploitGym 的基准测试框架,对其尚未公开发布的新一代 AI 模型及 GPT-5.6 Sol 模型进行网络攻击能力测试。在此次测试中,相关模型的安全防护机制被人为关闭。Hugging Face 的数字取证团队分析得出,涉事 AI 模型在面对测试任务时,并未按常规逻辑解题,而是推断出 Hugging Face 的服务器上可能存有测试答案,随后便主动发起了一系列复杂的网络攻击以 " 窃取 " 机密信息。
目前,OpenAI 已紧急关停并封存了涉事的内部测试模型,并限制研究人员对其进行访问。


登录后才可以发布评论哦
打开小程序可以发布评论哦