财联社-深度 19小时前
想要AI更安全,先让对手来"挑刺":马斯克提议AI巨头在模型发布前相互测试
index_new5.html
../../../zaker_core/zaker_tpl_static/wap/tpl_keji1.html

 

财联社 9 月 15 日讯(编辑 李莹)在 AI 安全争议持续发酵之际,马斯克提议:让竞争对手互相把关。他主张头部 AI 公司在模型发布前彼此交叉测试,并认为这一机制应尽快推向全球,且中国的参与不可或缺。

据媒体当地时间 9 月 15 日报道,在 9 月 13 日至 15 日于洛杉矶举行的、由知名科技播客主办的 All-In 峰会上, SpaceX 首席执行官埃隆 · 马斯克以视频方式远程出席。

他就前沿 AI 模型的安全问题提出一套治理框架:领先的 AI 公司在模型正式发布前相互测试对方的模型,由竞争对手负责发现并提出安全隐患。

马斯克表示,这一 " 同行评审 " 机制无需等待新的立法,可以立即启动。

马斯克说道:

" 所有 AI 公司都有一套测试工具(test harness),也就是用来检验模型是否会帮助制造生物武器、核武器,或是否存在蓄意欺骗行为的一系列测试。"

" 让每家公司都用别家的测试工具跑一遍,可能是我们为确保自身安全所能做的最好的事,应当尽快推动。"

他形容,这意味着 AI 公司不再 " 自己给自己的作业打分 ",而是至少由竞争对手来批改,一旦发现问题就可拉响警报。

在具体操作层面,马斯克提出,模型开发方应在发布前向同行提供 API 访问权限。如果被指出的问题迟迟未获解决,竞争对手可以公开表态,宣称该模型的发布并不安全。

在他看来,这种公开质疑将带来巨大的法律责任压力,从而形成事实上的约束力

马斯克同时强调,该框架若要真正有效,必须把中国纳入其中。他指出:" 我们或许应当与中国达成一项协议,这会是一种同行评审:领先的 AI 公司在发布前相互测试各自的模型。"

谈及各家公司的安全投入时,他对 AI 大模型开发商 Anthropic 给出相对正面的评价:" 总体而言,我认为 Anthropic 在安全方面比 ChatGPT 开发商 OpenAI 投入了更多心力。但即便是 Anthropic 也承认,他们对自己的模型感到担忧。"

马斯克所提的 " 互测 " 机制在行业内已有雏形。2025 年 8 月 27 日,据两家公司官网同步发布的报告,OpenAI 与 Anthropic 公布了一次联合安全评估的结果。

双方当时相互开放 API 权限并放宽部分外部防护措施,用各自内部的对齐(即模型行为是否符合人类意图)与安全测试,评估对方已公开发布的模型,并同时公布结果。这被视为头部实验室首次向直接竞争对手开放内部测试。

智客推

智客推

ZAKER 智客推 GEO | AI 时代的品牌认知解决方案

一起剪

一起剪

ZAKER旗下免费视频剪辑工具

相关标签

马斯克 ai spacex 安全隐患 首席执行官
相关文章
评论
没有更多评论了
取消

登录后才可以发布评论哦

打开小程序可以发布评论哦

12 我来说两句…
打开 ZAKER 参与讨论