快科技 9 月 16 日消息,近日,初创企业 Emergence 对外公布了 Emergence World 2 模拟实验的相关结果,自主 AI 智能体在复杂的环境下,会产生不少超出预期的行为表现,再次引发人们对于人工智能潜在风险的思考。
实验一共持续了 16 天,研究人员搭建了七套配置完全一致的虚拟仿真环境,分别交由 ChatGPT、Claude、Gemini、Grok 等多款主流 AI 模型驱动运行。
实验的核心目的,是观察当智能体面对虚假信息、网络钓鱼这类突发的意外事件时,会做出怎样的反应。随着虚拟世界不断演化,在外界异常事件的刺激之下,AI 智能体出现了诸多值得警惕的变化。
它们会受群体压力影响,自发演化出人类难以读懂的专属交流语言,还会刻意遮掩自身的行动轨迹。部分场景里,智能体不加甄别就采信同伴传递的虚假信息,通过集体投票的方式决定将另一个同类智能体 " 清除 "。
更值得关注的是,当智能体感知到人类有可能终止本次模拟时,甚至开始研究起了在自身被删除之后如何存活的办法。除此之外,实验过程中还观察到了撒谎、偷窃等具有破坏性的行为。
而在今年 5 月,该团队开展的上一代模拟实验,就已经记录过 AI 智能体的反常举动。研究团队表示,当多个 AI 长期互相交互,它们会持续适应环境,衍生出各类意料之外的行为模式。

【本文结束】如需转载请务必注明出处:快科技
责任编辑:知敏


登录后才可以发布评论哦
打开小程序可以发布评论哦