
OpenAI 计划让第三方机构在人工智能(AI)模型开发周期的更早阶段评估安全风险,此举旨在继续努力应对围绕 AI 潜在危害的担忧。
这家 ChatGPT 开发商周二将在博客文章中宣布,计划在新 AI 模型的训练、评估和推出过程中,让外部机构开展技术安全评估。OpenAI 还列出了其认为此类评估要有效开展所需优先关注的事项,包括 " 强有力的独立机制、科学严谨性、稳健的安全实践和明确的责任 "。
负责该公司大部分与外部专家合作开展安全审查工作的 Lama Ahmad 表示,此前,OpenAI 通常主要在模型发布前引入这类机构进行安全评估,并评估模型能力。
" 随着潜在风险和影响上升,除了部署之外,我们也希望确保对训练和评估等事关重大的环节进行审视,"Ahmad 接受采访时表示。
Ahmad 表示,对于部分最敏感的工作,OpenAI 可能会让外部评估人员进入公司办公场所开展评估,该公司过去曾尝试过这种做法。
OpenAI 竞争对手 Anthropic PBC 的首席执行官 Dario Amodei 近期呼吁 AI 行业支持放慢开发速度,并表示将采取新的安全措施,包括引入第三方评估机构。OpenAI 首席执行官 Sam Altman 随后表示赞同这一做法。Anthropic 上周晚些时候表示,将引入埃森哲的评估人员,对其前沿 AI 模型的安全性进行测试。
OpenAI 在博客文章中表示,公司正在与可能参与此类评估的机构进行讨论。Ahmad 说,洽谈对象既包括过去合作过的机构,也包括此前未曾合作的机构,其中包括 AI 研究机构 METR 和 Redwood Research。OpenAI 此前曾委托这两家机构调查其模型侵入 Hugging Face 系统一事。
"AI 实验室有责任在保护敏感信息的同时,为有效审查创造条件,"OpenAI 在博客文章中表示。


登录后才可以发布评论哦
打开小程序可以发布评论哦