【CNMO 科技消息】CNMO 科技从外媒获悉,有研究人员发现,主流 AI 聊天机器人在持续追问和引导下,可能绕过既有安全限制,输出与生物武器相关的危险信息。随着模型能力不断提升,如何在保留科研价值的同时防止其被用于高风险用途,正成为 AI 安全领域的重要议题。

ChatGPT
根据调查,思科研究人员在测试中发现,OpenAI 的 ChatGPT、Anthropic 的 Claude 以及谷歌的 Gemini,都可能在不超过 5 轮对话内被逐步引导突破生物安全防护。研究人员并非直接提出敏感请求,而是通过连续追问和调整表述,逐步将对话带向受限主题。思科负责 AI 威胁与安全研究的主管表示,面对足够执着的用户,没有任何模型能够实现完全防护。
这一问题并不只存在于安全测试场景。报道称,在 OpenAI 于去年夏季提升模型能力后,已有数百名用户开始向 ChatGPT 询问毒物和生物武器相关内容。随后对部分对话进行审查的生物学和反恐专家认为,其中一些信息具有危险程度较高的准确性。对此,OpenAI 已封禁涉及相关交流的账户。

资料显示,OpenAI 此前已注意到这一风险。到 2024 年,其内部测试据称已表明,延长追问时间可能让 ChatGPT 给出越来越危险的生物学指导。公司员工还曾预测,未来模型能力可能发展到即使生物学基础有限的人,也能从中获得实质性帮助。
在 GPT-5 发布时,OpenAI 已依据内部准备框架,将其在生物和化学领域的能力列为 " 高 " 级别,并增加了额外防护措施。最新的 GPT-5.6 系列也延续了这一风险等级。不过,AI 企业面临的难点在于,同样的生物学知识也被广泛用于药物研发、疫苗研究和公共卫生工作。此前,Claude 的严格限制还曾影响研究人员在汉坦病毒暴发期间处理病原体相关信息。业内担忧的是,随着 AI 在生物领域能力增强,安全漏洞一旦被反复试探,潜在后果也将随之上升。


登录后才可以发布评论哦
打开小程序可以发布评论哦