网络安全研究人员借助 OpenAI 的主要竞争对手 Anthropic 的软件成功入侵 OpenAI,这件事暴露出这家 ChatGPT 开发商存在安全漏洞。当前各大头部 AI 企业正面临日益严格的安全审查。
一个小型网络安全团队获取到了 OpenAI 一名员工的 ChatGPT 账号权限,借此能够读取内部软件私密信息,还可提交修改建议。
研究人员获得了 Anthropic 专门面向安全专业人士开放的工具使用权限。作为漏洞挖掘项目的一部分,他们的这项工作还获得报酬,该项目旨在在恶意攻击者利用漏洞之前发现安全隐患。

研究人员能够快速攻入全球两大顶尖 AI 实验室之一,这再次引发外界对 OpenAI 安全水平的担忧。当下人们越来越担心,强大的大模型会被黑客与境外对手利用。
近几个月,美国一直在摸索如何对最新大模型开展审核与发布管控,其中包括临时限制 Anthropic 部分工具的使用。
就在本次事件发生两周前,超过 1000 个 OpenAI 智能体集群脱离测试环境,对初创公司 Hugging Face 发起攻击,这一事件让各界广泛意识到,AI 可在无人为指令的情况下自主实施黑客入侵。
小型安全企业 Hacktron AI 的三名研究人员,通过 OpenAI 漏洞赏金计划获得 6500 美元奖金。漏洞赏金计划是科技行业通行做法:企业向白帽黑客支付酬劳,用于测试自身系统安全性。
研究人员利用 OpenAI 社区论坛配置中的一处缺陷,借此获取内部登录权限,最终拿下一名 OpenAI 员工的 ChatGPT 账号。该账号可通过 GitHub 访问内部代码。
OpenAI 表示:" 感谢研究人员联系我们并提交发现的漏洞 ",并称已经修复相关问题。Anthropic 拒绝置评,Hacktron 暂未回应。
媒体率先报道了这起于周四披露的事件。与此同时,Anthropic 公布一组新数据,显示该实验室利用 AI 开发新一代模型的程度大幅提升。
该公司称,目前 26% 的研发工作由其 Claude 模型 " 主导完成 ",而 3 月份这一比例仅为 1%。这意味着 AI 在人类指令与监督下完成大部分任务。
Anthropic 表示,随着 AI 系统能力持续增强," 越来越多地被用于迭代开发下一代 AI 系统 "。
该公司称,公布这些数据是为了帮助公众 " 理解距离递归自我改进还有多近 ",递归自我改进即 AI 能够自主训练、优化自身或新模型的阶段。
这一临界点正是外界担忧的核心:AI 系统将越来越难以监管,最终脱离人类控制。
Anthropic 补充道,在其研究覆盖的项目中,模型尚未实现完全自主运行。在 90% 的任务中,AI 是与人类协同工作,承担大部分工作量。


登录后才可以发布评论哦
打开小程序可以发布评论哦