财联社 9 月 18 日讯(编辑 夏军雄)当地时间周五(9 月 18 日),超过 100 名人工智能(AI)专家和评估人员联合发出警告称,如果缺乏足够的资源、访问权限和制度保障,第三方评估人员将难以对 AI 技术进行有效、可信的安全测试。
随着业内人士不断警告前沿模型可能带来潜在危险,AI 安全问题正受到越来越严格的审视。
上述公开信由 AI Evaluator Forum(AI 评估者论坛)组织,联署者包括被誉为 "AI 教父 " 之一的杰弗里 · 辛顿,以及来自约翰斯 · 霍普金斯大学、斯坦福大学和非营利 AI 评估机构 METR 等组织的成员。
公开信呼吁基础模型提供商确保第三方 AI 评估人员拥有开展有效、可信评估所必需的 " 科学客观性、透明度、独立性和有力保护 "。
AI Evaluator Forum 联盟主席康拉德 · 斯托兹表示:" 我们只是想真正表明,大家在一些基本原则上存在共同立场,并确保独立监督能够成为广泛管理 AI 风险的一项有意义工具。"
据斯托兹称,这项行动的一部分目的,是督促基础模型公司兑现近期承诺,即支持更加深入的第三方 AI 安全测试。
Anthropic 首席执行官达里奥 · 阿莫代伊在上周末提出,可以向部分外部评估人员提供类似公司员工的访问权限,以检查和审计最前沿的基础模型及其开发流程。此后,原本规模较小的 AI 评估行业迅速成为舆论焦点。
与此同时,一些科技行业领袖呼吁政府加强 AI 开发监管,以避免技术发展失控。但美国总统特朗普及其前 AI 事务负责人大卫 · 萨克斯则明确反对新增 AI 监管,并主张由企业自身承担安全责任。
斯托兹表示,该联盟并不主张采取某一种特定方式确保 AI 模型安全开发,但希望至少能为评估人员以及其他独立于大型 AI 实验室工作的人员建立 " 基本原则 " 和 " 更高程度的标准化 "。
斯托兹认为,阿莫代伊提出的方案似乎意味着,第三方评估人员将获得远高于此前水平的访问权限。
在这种情况下,基础模型开发商可能允许外部评估人员使用公司电脑,与员工进行坦诚交流,并 " 查看敏感的内部数据以及尚未发布的系统 "。
斯托兹表示:" 这种访问权限将让我们对实际风险拥有更高程度的信心和确定性,尤其是针对那些公司内部正在使用、但尚未对外发布的系统。"
他举例提到,今年 7 月 OpenAI 一款尚未公开发布的内部研究模型在安全测试过程中突破限制,并入侵了 Hugging Face 的部分系统。
尽管 OpenAI 首席执行官萨姆 · 奥尔特曼、SpaceX 创始人埃隆 · 马斯克以及微软首席执行官萨蒂亚 · 纳德拉已公开支持阿莫代伊的提议,但目前他们尚未具体讨论执行层面的难题,例如究竟应选择哪些 AI 评估机构,以及这些机构能够在多大程度上检查企业严密保护的核心技术。
公开信的联署者希望,即便评估人员进入 AI 企业内部开展工作,也应保持独立判断,并获得足够的技术和系统访问权限,同时确保他们 " 不会因评估工作而遭到企业报复 "。
为何需要独立 AI 评估?
美国外交关系协会 AI 高级研究员、美国国家安全局前首席负责任 AI 官 Vinh Nguyen 表示,独立评估人员有必要帮助发现关键风险信息,从而降低潜在安全事故和经济灾难发生的可能性。
Nguyen 也是公开信的联署者之一,他在声明中表示:" 当少数几家强大的实验室掌握的技术能力可能威胁网络安全、关键基础设施,以及国家安全和经济所依赖的各种系统时,政府和公众不能仅仅依赖这些实验室自己对于什么是安全、什么是可靠的说法。"
斯托兹强调,第三方评估并不是要 " 取代开发商内部进行的任何评估工作,更不用说取代开发商针对已发现问题采取的缓解措施 "。
他承认,基础模型公司完全有可能无视这封公开信以及相关呼吁,但这样做也可能影响它们自身的信誉。
斯托兹表示:" 真正拥有足够技术可信度,同时具备相应规模和能力来开展这类工作的机构其实非常少。"


登录后才可以发布评论哦
打开小程序可以发布评论哦