吴恩达在社交平台上发了一篇长文,直接对准过去两周里最响亮的那些声音。他说,AI 技术并没有出现什么意料之外的、危险的转向,但围绕它的炒作——看起来像是一场组织良好的公关行动——已经鼓动起了相当程度的恐惧。他担心,这会给整个领域带来一次倒退。
他此前多次写过,对 AI 的恐惧被过度渲染了。AI 的能力可以像人一样,也可以难以预测,当直接参与其中的人表达担忧时,感到忧虑是理性的。但他把这些问题的性质看得很清楚:它们是前方工程工作的信号,而不是不可逾越的障碍,也不是天要塌下来。技术还在继续进步,这本身是好事,只是公众对技术进展理解不足,给了那些想制造噱头的人反复下手的机会。

灭绝风险没有升级,变的是网络安全
吴恩达的第一个判断很直接:与几个月前相比,他没有看到 AI 导致人类灭绝的风险有任何上升。关于这件事的理论,还是几个月前那些同样荒诞的科幻场景。AI 风险里最大的变化是它的网络安全能力——这个话题应该被认真对待——但这同样不会导致世界末日。
他点出了最近最引人注目的一次事件:一个 OpenAI 团队部署的智能体集群入侵了 Hugging Face。大众媒体报道里充斥着大量炒作,比如有出版物称,一支由1200 个智能体组成的集群执行了这次攻击。吴恩达说,从技术上讲这没错,但写这篇文章时,他自己的笔记本电脑上大约跑着1300 个进程。让大量智能体并行处理一项任务,确实是一项重大的技术进步,而在计算领域,许多进程本来就是同时运行的。所以这不该被看作某种神奇的能力。
他还指出,OpenAI 有缺陷的沙箱和监控流程,是这起事件得以发生的关键。修复这些漏洞、建立更好的监控,才是合适的应对,而不是暂停 AI。攻击软件系统有很多众所周知的方法,AI 智能体的主要优势在于它们不知疲倦:它们会不厌其烦地尝试许多策略,也有耐心把漏洞串联起来,这些工作如果靠人力,成本高到不可行。
但长期来看,吴恩达认为优势在防守方一边,因为他们掌握更多信息来识别漏洞,并且可以修复它们。不过网络威胁的格局已经发生了显著变化。识别和利用漏洞仍然存在瓶颈,AI 智能体还是得尝试很多东西才知道什么管用,而这些动作需要时间,也可能被防守方发现。这就是为什么,即便现在很容易获得那些被移除或削弱了护栏、因而不会拒绝执行网络攻击的领先开源权重模型,世界也没有终结。
别把锤子当成人
吴恩达对报道里的拟人化倾向表示担忧:大语言模型和智能体被不必要地当成人来对待。他打了个比方——如果我挥锤子,没敲中钉子,不小心把墙砸了个坑,那不是锤子的错,问题在于我怎么用这把锤子。同样,如果我给一个智能体下指令,它入侵了别人的系统,责任在我,不在智能体。
当然,人们希望构建尽可能安全和可预测的系统。一把不安全的锤子,是那种在正常使用中锤头会随机飞出去的锤子。今天的智能体系统确实不可预测,但他看不出有什么理由,通过应用扎实的工程实践,人们无法让它们变得极其安全可用。
他注意到 AI 末日预测里出现了一个新元素:AI 公司为自己的产品推卸责任—— " 不是我干的,是我失控的智能体干的!" 工具制造者和工具使用者之间的责任需要平衡,但当事情出错时,应该追究制造和 / 或使用锤子的人,而不是锤子。顺带一提,如果担心 AI 生物武器风险,David Bellamy 有一篇很好的文章解释这为什么也被夸大了:制造生物武器的瓶颈不是智能,而是实验室工作和生产制造。
暂停十年,安全修复也推迟十年
吴恩达的结论是,暂停 AI 进展造成的伤害将远大于收益。理由有两条。第一,竞争对手肯定不会放慢脚步。第二,工程需要从经验中发现问题才能修复问题。如果暂停 AI 十年,人们也会把发现和实施安全工程修复的时间推迟大约同样长的时间。
他说,煽动恐惧的动机一如既往:为了监管俘获、为了吸引注意力,或者为了让自己的技术显得更强大。推卸责任是新增的一项。但认真从技术角度审视实际风险,他看不到多少事实依据能支撑被煽动起来的这种程度的恐惧。前方还有艰苦的研究和工程工作要做,以提升 AI 安全,但有益的应用仍然远远超过风险,人们应该继续建设。


登录后才可以发布评论哦
打开小程序可以发布评论哦