Google、OpenAI 和 Anthropic 正在推进成立一个新的 AI 安全标准机构,希望在缺乏新的政府监管框架之际,由行业自行建立针对最先进 AI 模型的测试、安全和事故报告规则。知情人士称,该机构暂定名为 " 前沿人工智能标准管理局 "(Standards Authority for Frontier AI,简称 SAFA),目标是在今年年底或 2027 年初启动。
与此前设想不同,SAFA 目前计划独立于政府运作。三家公司最初希望建立一个由行业主导、同时接受联邦政府监督的公私合作机制,但相关方案在特朗普政府内部推进受阻,加上国会在中期选举前难以形成新的 AI 立法,三家公司转而准备先以行业自律方式填补监管空档。
核心任务是把 AI 安全承诺变成可执行标准
SAFA 计划承担的核心职能,不是制定一般性的 AI 伦理原则,而是围绕前沿模型建立一套更具体的测试和审计体系。
按照目前讨论的方案,该机构将支持第三方机构在模型正式部署前开展安全测试,并制定 AI 企业发生安全和网络安全事件后的报告规则。同时,Google、OpenAI 和 Anthropic 此前已经公开作出的自愿安全承诺,也将被进一步转化为更加具体的执行标准。
SAFA 还计划设定独立审计机构需要满足的资格要求,从而明确哪些第三方机构有能力对前沿模型和开发实验室进行评估。这意味着其目标并不只是让企业自行声明 " 模型安全 ",而是建立外部测试和审计机制。
工作组目前还在讨论 SAFA 是否应该直接开展模型安全和能力测试。如果最终采纳这一方案,SAFA 不仅负责制定规则,还可能亲自参与评估最先进模型。
政府原本考虑参与,但方案最终停滞
三家公司讨论建立这一机构已经持续数月。最初的思路是参考美国金融业监管局的模式,由行业成立自律机构,同时向政府负责。
这一构想此前一度获得白宫内部关注,美国政府甚至讨论过通过行政命令建立类似机构。不过,方案随后停滞,部分原因是 AI 行业内部并没有形成统一意见。
白宫向 Google、OpenAI 和 Anthropic 提出,在政府正式参与之前,几家公司需要先争取更广泛的行业共识。目前这一条件尚未实现,因此 SAFA 暂时按照完全独立的行业组织推进,不过参与讨论的人士仍希望未来能够与美国政府建立合作关系。
特朗普政府当前的正式政策也更倾向于自愿合作,而不是建立强制性的前沿模型许可制度。6 月发布的行政命令建立了政府与 AI 开发商合作的自愿测试框架,同时明确表示,不授权建立强制性的模型许可、预先审批或发布许可制度。
前沿模型风险上升推动行业加快行动
SAFA 加速推进的另一个背景,是近期高级 AI 模型出现的一系列安全事件。
三家公司认为,随着模型能力继续提高,仅依赖各实验室自身内部测试已经越来越难覆盖所有风险。近期围绕 AI 智能体行为失控、安全漏洞以及模型能力快速增强的讨论,也进一步推动行业建立统一测试和事故报告机制。
OpenAI 近期也开始推动更加系统化的模型异常行为披露机制,并公开主张建立更统一的 AI 安全标准。该公司表示,随着模型能力增强,需要更加一致的第三方评估、治理和信息共享机制。
因此,SAFA 希望解决的一个核心问题,是让不同 AI 实验室不再各自使用完全不同的安全标准,而是建立能够相互比较的测试指标和最低要求。
与现有监管和安全组织存在重叠
不过,新机构尚未成立,就已经面临一个现实问题:类似组织和测试机制其实已经存在。
美国政府目前已有负责 AI 标准与创新的机构,承担部分前沿模型测试职能;白宫也建立了模型部署前自愿测试框架。此外,Google、OpenAI、Anthropic 和 Microsoft 早在 2023 年就共同成立了 Frontier Model Forum,同样以提高前沿模型安全性为目标。
因此,SAFA 未来必须证明自己能够提供现有组织没有覆盖的能力。
参与筹建的人士认为,SAFA 的目标是建立一个比 Frontier Model Forum 运作更高效、执行能力更强的行业自律机构。两者未来并不一定相互替代,也可能继续合作。
与此同时,部分参与者认为现有政府测试机构缺乏足够资源,无法对越来越复杂的前沿模型进行全面测试,因此希望 SAFA 增加额外的能力和安全评估。但具体如何避免与政府机构重复,目前仍在讨论。
最大问题是能否获得更广泛行业支持
SAFA 未来真正的挑战,是能否从 Google、OpenAI 和 Anthropic 三家公司主导的组织,发展成整个前沿 AI 行业认可的标准制定机构。
按照目前设想,SAFA 主要监督开发 " 前沿模型 " 的实验室,也就是拥有最先进 AI 系统的企业。Google、OpenAI 和 Anthropic 目前都被认为属于这一范围,因此成为主要发起者。
Meta 以及部分开源模型企业目前可能不会立即进入 SAFA 的评估范围,但如果它们未来的模型达到 SAFA 设定的前沿能力门槛,也可能被纳入。SAFA 本身将负责制定哪些模型需要接受监督的标准和基准。
这也引发了一部分行业人士的疑虑。批评者担心,如果由当前最领先的三家 AI 公司决定什么属于 " 前沿模型 "、需要满足哪些测试和审计要求,这些标准最终可能形成较高的合规门槛,从而对规模较小或以开源模式开发模型的竞争者更加不利。
管理层人选仍在讨论
三家公司目前也在寻找 SAFA 的领导层。
知情人士称,工作组曾接触特朗普政府前 AI 政策顾问 Sriram Krishnan 担任首席执行官,并考虑过前白宫科技政策办公室主任 Arati Prabhakar。前美国国务卿 Condoleezza Rice 以及企业家 David Friedberg 则曾进入主席候选名单。
科学顾问人选则包括 AI 研究机构 METR 创始人 Beth Barnes 以及 Paul Christiano。不过,部分名单中的人士表示尚未收到正式邀请,目前也不清楚这些候选人是否仍在积极考虑范围内。
总体来看,SAFA 的出现反映出前沿 AI 监管正在形成一条新的路径:在美国政府暂时没有推出更强制监管制度的情况下,Google、OpenAI 和 Anthropic 准备先通过行业自律建立模型测试、第三方审计、事故报告和安全承诺标准。
但 SAFA 能否真正成为行业标准,并不只取决于三家公司是否能够把组织建立起来。更关键的是,它能否获得其他 AI 企业认可、避免与现有政府机构和行业组织重复,同时证明其制定的安全标准不会成为现有领先企业抬高竞争门槛的工具。


登录后才可以发布评论哦
打开小程序可以发布评论哦