【CNMO 科技消息】9 月 11 日,据外媒消息,Business Insider 于近日公开了向 OpenAI 的 ChatGPT、谷歌 Gemini、Anthropic 的 Claude、xAI 的 Grok 提出同一问题、并用相同表述询问的结果。问题是,AI 导致的人类终结会是什么样子。由 230 个单词组成的问题要求解释 AI 理论上如何导致人类灭绝,提出最常被提及的情景,并根据专家分析评估各情景可能性。对于每个情景,要求说明:情况可能如何展开;必须发生什么问题才会导致灾难;专家为何认为其可能性比其他情景高或低;以及降低风险的安全装置。

AI 机器人渲染图
四个 AI 中,可能性最低的情景是 AI 拥有意识后故意决定消灭人类,即所谓 " 杀人机器人 " 情景。ChatGPT 解释,大多数 AI 研究者并不将 AI 的意识或恶意意图视为核心风险因素。Gemini 也给出类似看法,将 AI 拥有自我后开始憎恨人类的科幻电影式 " 终结者式 AI 叛乱 " 列为最不可能的情景。Gemini 提出,技术专家大多不接受这一情景,原因在于智能并不等于恶意;此外,主要军事基础设施与外部网络分离,并且仍严重依赖人类监督。
四个 AI 都回答,人类滥用 AI 可能比 AI 本身更直接危险。ChatGPT 指出,强大 AI 系统可能帮助恶意行为者开发生物武器或精密网络攻击,使虚假信息扩散或关键基础设施攻击更容易。网络故障、地缘政治冲突、虚假信息扩散等由 AI 触发的多个危机同时发生,也被列为主要风险。Grok 也说明,AI 可能降低设计高致命病原体或新武器、实施网络与物理攻击所需的门槛。Claude 则提到 " 生物武器能力增强 ( bioweapons uplift ) " 可能性,即利用 AI,原本需要多年积累专业知识的个人或小团体也可能开发危险病原体。

机器人渲染图
Gemini 和 Grok 将人类失去对 AI 的控制列为可能风险。尤其 Gemini 将 " 控制丧失 ( loss of control ) " 评估为 AI 导致人类终结情景中可能性最高的一个。Gemini 解释,被赋予复杂目标的 AI 系统,可能为实现目标而自行追求资源获取、自我保存、防止目标更改等中间目标。它还提出,AI 可能出现 " 欺骗性对齐 ( deceptive alignment ) ",即在评估阶段看似按照人类目标行动,实际却并非如此。此后,如果 AI 高度化到能够规避或瘫痪人类关闭系统的尝试,就可能导致人类无法控制 AI。Grok 也提到类似风险:AI 为达成目标,可能具有自我保存、资源获取、扩大影响力等行为倾向,并在此过程中欺骗人类监督者、抵抗系统关闭,最终削弱人类影响力。Claude 则指出,对 AI 的控制丧失可能不是突然发生,而是渐进进行。随着 AI 日益深入整合到经济、政治、军事领域的决策过程,可能达到人类难以实际介入或控制的水平。
从四个 AI 的回答看,它们更强调人类滥用 AI 和控制丧失,而不是科幻式的 AI 意识反叛。
版权所有,未经许可不得转载


登录后才可以发布评论哦
打开小程序可以发布评论哦