9 月 17 日,围绕”AI 紧急关闭按钮能否阻止失控”的讨论再度升温。多名 AI 行业领袖与研究人员认为,被部分政策制定者寄予厚望的紧急关闭开关,未必能成为解决 AI 失控风险的万能手段。
据《商业内幕》9 月 17 日报道,一些政策制定者希望用”按下开关让 AI 直接下线”的方式消除”AI 突然失控发动毁灭性网络攻击”的潜在威胁,但现实恐怕没这么简单。
辛顿:长远来看行不通
被称为”AI 教父”的计算机科学家杰弗里·辛顿直言:”我认为这种办法从长远来看行不通。等 AI 拥有超级智能后,它会比人类聪明得多,完全可能说服掌管开关的人不要按下它。”
从技术上看,企业可以通过紧急关闭机制停用自行托管的模型,也可以切断 AI 使用工具与算力资源的权限。但辛顿并不是唯一一个怀疑这套办法是否足够的人。也有 AI 行业人士认为,紧急关闭开关确实可能发挥作用,同时存在被”绕过”的可能,或者等到启动时已经太迟,因此最多只能成为完整安全体系中的一道防线。
索亚雷斯:别逼近无法回头的临界点
AI 安全研究人员、《如果有人造出来,所有人都会死》合著者内特·索亚雷斯认为,只要 AI 仍受制于某个物理地点,关闭开关就能发挥作用;一旦 AI 突破限制、复制自身,甚至进入关键基础设施,关闭机制是否还能有效就很难保证。
他指出,关闭开关当下”确实存在”,但人类不应该逼近某些无法回头的临界点。真正应该优先做的,是从源头上阻止危险 AI 系统被开发出来。
企业高管:必要,但作用有限
部分 AI 企业高管则认为,紧急关闭开关有必要存在,但作用有限。
Anthropic 联合创始人杰克·克拉克指出,未来或许需要强制企业保留一套紧急关闭机制,且能够接受独立第三方验证。大型 AI 实验室目前都有办法”拔掉插头”,但由多个自主 AI 智能体组成的集群,理论上可能绕过这些控制手段。
Anthropic CEO 达里奥·阿莫迪持有类似看法:紧急关闭开关看似是好主意,可绝非”万能药”。如果 AI 模型能力足够强,就可能想办法绕过关闭措施,因此紧急关闭机制只能作为更广泛安全策略的一部分,还需要配合测试、外部评估以及部署限制等措施。
奥尔特曼:不存在”神奇红色按钮”
对 AI 紧急关闭开关局限性的担忧并非最近才出现。OpenAI CEO 萨姆·奥尔特曼在 2024 年接受《经济学人》采访时,就否定了靠一个万能保险装置解决 AI 风险的想法,称不存在一个能让 AI 立即停止的”神奇红色按钮”。
在奥尔特曼看来,AI 安全并不取决于某个单一开关,而取决于一连串具体决策,包括允许模型具备哪些能力、何时部署,以及如何控制风险。”这不是一个简单的开或停决定,而是整个过程中许多个小决定共同作用的结果。”
安全是体系,不是开关
从辛顿到阿莫迪,再到奥尔特曼,业界主流观点趋于一致:紧急关闭开关有价值,却绝非兜底方案。真正可行的路径,是把测试、外部评估、部署限制与开发源头管控组合成一套完整的安全体系,而不是把希望寄托在一个”按下就能拯救世界”的红色按钮上。
