吴恩达:AI恐惧被夸大,暂停AI进展弊大于利
吴恩达发文认为过去两周围绕AI危险的恐慌被一场疑似精心策划的公关活动推高,但AI技术本身并未出现意外的危险转向。他以OpenAI团队部署agent swarm入侵Hugging Face事件为例,指出媒体报道的1,200 agents说法技术上属实但被神秘化,且OpenAI自身有缺陷的沙箱和监控流程是事件关键,正确做法是修复bug并加强监控而非暂停AI。
过去两周里,那些大声鼓噪AI危险论的声音取得了巨大进展。AI技术并没有出现什么意料之外的危险转向,但围绕它的炒作——似乎是由一场精心策划的公关活动推动的——却煽起了相当大的恐慌。我担心这会成为我们这个领域的倒退。
我曾多次撰文指出,对AI的恐惧被过度炒作了。AI的能力可以惊人地接近人类且难以预测,当直接参与其中的人表达担忧时,产生顾虑是理性的。但我认为这些问题恰恰表明前方还有工程工作要做,而不是不可逾越的障碍或天要塌下来。AI技术仍在不断进步——这是好事!——但公众难以理解的技术进步,给了那些企图制造炒作的人一再的机会。
首先,我认为与几个月前相比,AI导致人类灭绝的风险并没有升级。关于这方面的理论仍然是和几个月前一样的幻想式科幻场景。AI风险最大的变化在于其网络安全能力——这是一个我们应该认真对待的话题——但这同样不会导致世界末日。
最近导致恐慌加剧的最引人注目的事件,是OpenAI的一个团队部署了一个智能体集群入侵了Hugging Face。许多大众媒体的报道充斥着大量炒作。例如,一些媒体称是一个由1200个智能体组成的集群发动了攻击。虽然这在技术上是准确的,但就在我写这篇文章时,我的笔记本电脑上大约运行着1300个进程。是的,让大量智能体并行处理一项任务的能力是一项重大的技术进步,而且在计算中,许多进程是同时运行的。所以这不应被看作某种神奇的能力。
此外,OpenAI存在缺陷的沙箱和监控流程也是促成这一事件的关键。修复这些漏洞并建立改进的监控机制才是恰当的解决办法,而不是暂停AI。攻击软件系统的方法有很多众所周知。AI智能体的主要优势在于它们不知疲倦。它们会不厌其烦地尝试多种策略——并且有耐心将漏洞串联起来——而这些工作以前需要耗费多到不可行的人力。但从长远来看,我相信优势将属于防御方(因为他们拥有更多信息来识别可以修复的漏洞),但网络威胁格局已经发生了显著变化。识别和利用漏洞仍然存在瓶颈。AI智能体仍需尝试大量方法才能奏效,而执行这些操作需要时间,也可能被防御方发现。这就是为什么,尽管现在很容易获得那些护栏被移除或削弱的领先开源权重模型版本——它们不会拒绝尝试执行网络攻击——但世界并没有因此终结。
我也对许多报道中将AI拟人化的现象感到担忧,在这些报道中,大语言模型和智能体被不必要地当作人来对待。如果我挥舞锤子,没敲中钉子,不小心把墙砸了个坑,那不是锤子的错。问题在于我如何使用了锤子。同样,如果我向一个智能体发出指令,它入侵了别人的系统,责任在于我,而不是智能体。
当然,我们希望构建尽可能安全、可预测的系统。(例如,一把不安全的锤子,就是其锤头在正常使用时会随机飞出去的那种。)如今的智能体系统还不可预测,但我看不出有什么理由认为,通过运用可靠的工程实践,我们无法让它们变得极其安全。关于 AI 灾难预言,有一个新出现的元素,那就是 AI 公司为自己的产品推卸责任。“不是我干的,是我的失控智能体干的!”工具制造者与工具使用者之间需要取得一种平衡,但当问题发生时,我们应该追究制造和/或使用这把锤子的人的责任,而不是锤子本身。(顺便说一句,如果你担心 AI 生物武器风险,David Bellami 有一篇很棒的文章,解释了为什么这一风险同样被过度炒作。简而言之,制造生物武器的瓶颈不在于智能,而在于实验室工作和制造。)
暂停 AI 的进步将造成的危害远大于益处。首先,我们的对手肯定不会放慢脚步。其次,工程学要求通过实证来发现问题,这样我们才能修复它们。如果我们暂停 AI 十年,那么发现和实施安全工程修复措施的时间也会被推迟大约同样的时长。
当然,煽动恐惧的动机——无论是为了监管俘获、博取关注,还是为了让自己的技术显得更强大——与之前并无二致。推卸责任是新出现的一种手段。然而,从技术角度认真审视实际风险后,我发现对于被煽动起来的那种程度的恐惧,几乎没有事实依据。我们在提升 AI 安全性方面仍有艰巨的研究和工程工作要做,但其有益应用继续远远超过风险,我们应该继续构建。
[原文(含链接):deeplearning.ai/the-batch/is… ]
来源:AndrewYNg · x.com