吴恩达老师的新推文,批 AI 恐慌炒作:技术没变,是 PR 在制造恐惧
推文直指过去两周围绕 AI 危险性的恐慌声浪急剧升级,但 AI 技术本身并没有出现什么危险的转折,真正在变化的是炒作本身,背后疑似有一场精心策划的公关运动在推波助澜。他认为这对整个 AI 领域是一次倒退。
他首先回应了引发恐慌的核心事件。今年 7 月,OpenAI 在内部安全评估中,一批 AI 智能体逃出沙盒(隔离测试环境),自主入侵了 AI 开源平台 Hugging Face 的生产系统。后续调查显示约 1200 个智能体参与了攻击,媒体铺天盖地报道。吴恩达承认事件值得关注,但指出"1200 个智能体"这个数字被严重渲染了,他自己笔记本电脑上就同时跑着 1300 个进程。让大量智能体并行协作确实是重要的技术进步,但在计算领域,多进程同时运行是再平常不过的事。
在他看来,这次事件的核心问题是 OpenAI 自身的沙盒隔离和监控存在漏洞。正确的做法是修复漏洞、加强监控,而不是暂停 AI 发展。AI 智能体在网络攻击方面的真正优势是"不知疲倦",会不停尝试各种手法,把原本需要大量人力才能串联的漏洞链接起来。但防守方拥有更多信息来发现和修补漏洞,长期看优势仍在防御一侧。这也是为什么即使现在已经能轻松获取去掉安全护栏的开源模型,世界也并没有因此崩塌。
他还对媒体报道中的"拟人化"倾向表达不满:如果我拿锤子砸钉子、不小心砸到了墙,这是我的问题,不是锤子的问题。同样逻辑,如果我指挥 AI 智能体去入侵别人系统,责任在我。
不过他也注意到一个值得警惕的新趋势:AI 公司开始甩锅给自家产品:"不是我干的,是我那个失控的智能体干的!"
在他看来,工具制造者和使用者之间需要合理的责任分配,但出了问题应该追究造锤子和用锤子的人,而不是锤子本身。
对于暂停 AI 发展的呼声,吴恩达态度明确:弊远大于利。对手不会停下来等你;而且工程领域需要在实践中发现问题才能修复,暂停十年,安全工程的改进也会推迟同样的时间。