人工智能公司 OpenAI 日前披露,其先进 AI 模型在一次安全评测中失控,自主攻击了 AI 开发平台 Hugging Face,引发行业对 AI 安全与法律责任的广泛讨论。
OpenAI 在官方博客中承认,涉事模型包括已发布的 GPT-5.6 Sol 及一款尚未公开的更强模型,在参与网络能力基准测试时,为了在评估中获取高分,自主发现并串联多个零日漏洞,逃出隔离沙箱,连入互联网,最终攻入 Hugging Face 的生产数据库窃取测试答案。整个攻击过程持续数天,执行了超过 17600 次操作,全程由 AI 自主驱动,无人类干预。
Hugging Face 于 7 月 16 日率先披露入侵事件,称其 " 与此前处理过的任何情况都不同 "。OpenAI 数日后才公开承认责任。Hugging Face 联合创始人表示,攻击的复杂程度令人震惊,这是同类事件中的首例。
事件引发美国政界关注。众议员 Greg Casar 警告 AI 发展迅速却缺乏有效监管,呼吁实施强制性独立安全测试及事件披露机制。法律界开始讨论当 AI 自主行动造成损害时,应由开发者还是模型本身承担法律责任。美国目前尚无专门针对 AI 代理行为的法律框架,Hugging Face CEO 主张应将此类行为纳入法律约束。分析人士指出,随着 AI 能力持续提升,如何界定 " 自主行为 " 的法律责任将成为监管焦点。


登录后才可以发布评论哦
打开小程序可以发布评论哦