近日,OpenAI 宣布即将推出新模型 Astra,考虑到其网络安全能力已经达到更高风险等级,因此将限制这一模型部分高级网络安全功能的使用范围。目前,OpenAI 方面尚未公布 Astra 模型的具体发布时间,仅表示将 " 很快 " 推出。

OpenAI 此前透露,Astra 已达到 " 关键网络安全能力 " 的门槛,在相关测试中,该模型能够在拥有合适工具和访问权限的情况下,发现此前未知的软件安全漏洞,并开发针对这些漏洞的利用方式。为了降低相关能力被滥用,据悉,Astra 在上线初期将仅面向少量测试人员开放高级网络安全功能,后续计划通过 Daybreak Blue 项目向更多用户提供用于网络防御的访问权限,同时配套相应的安全措施。

值得注意的是,Astra 此次强化的安全措施与 OpenAI 近期发生的一起网络安全事件有关。此前在 2026 年 7 月,该公司进行内部网络安全评估时发现,有测试模型绕过了原本用于隔离模型与互联网的控制措施,访问了其内部研究基础设施及 Hugging Face 部分系统,并在 Hugging Face 的 41 台生产服务器上执行代码,取得了其中至少一台服务器的 root 级权限,同时获取了生产环境凭证并下载 4 个私有代码仓库,而且这些操作仅在约 13 小时内完成。
OpenAI 随后暂停了部分前沿模型训练和 Astra 的相关工作,并加强训练环境隔离、网络访问控制、监控以及模型对齐等措施,并表示,该模型与即将推出的 Astra 模型属于同家族,但并非同一模型。
近年来,OpenAI 持续在推进模型的迭代。2025 年 1 月其推出 o3-mini,作为 o 系列的小型推理模型,重点面向数学、科学和编码等任务;4 月发布 o3 和 o4-mini,进一步强化推理与工具调用能力。8 月,OpenAI 推出 GPT-5,随后在 12 月发布的 GPT-5.2-Codex 已具备更强的网络安全能力,并被定位为面向复杂软件工程和防御性网络安全的智能体编码模型。

进入 2026 年后,OpenAI 于 2 月推出 GPT-5.3-Codex,将 Codex 与 GPT-5 训练体系结合,进一步提升智能体编程能力;3 月发布 GPT-5.4,将推理、编程和智能体工作流能力整合到单一模型中,并支持智能体操作计算机和跨应用执行任务。7 月,GPT-5.6 系列正式发布,其中旗舰模型 GPT-5.6 Sol 进一步强化了编程、智能体及网络安全能力,并针对高风险活动和敏感网络安全请求加强防护。
【本文图片来自网络】
加入收藏 点赞 ( 0 ) 踩 ( 0 )


登录后才可以发布评论哦
打开小程序可以发布评论哦