“紧急关闭”按钮真能阻止 AI 失控?“AI 教父”辛顿、Anthropic CEO 阿莫迪都不看好

浏览13次 点赞0次 收藏0次

9 月 17 日消息,如今,“AI 突然失控发动毁灭性网络攻击”的潜在情景正日益引起行业重视,如果按下“紧急关闭”开关让 AI 直接下线,问题看似就能得到解决。然而,多名 AI 行业领袖和研究人员认为,现实恐怕没这么简单。

据《商业内幕》今天(17 日)晚间报道,一些政策制定者寄予厚望的紧急关闭开关,未必能成为解决 AI 失控风险的万能手段。

被称为“AI 教父”的计算机科学家杰弗里 · 辛顿直言:“我认为这种办法从长远来看行不通。等 AI 拥有超级智能后,它会比人类聪明得多,完全可能说服掌管开关的人不要按下它。”

从技术上看,企业可以通过紧急关闭机制停用自行托管的模型,也可以切断 AI 使用工具和算力资源的权限。

从报道中获悉,辛顿并不是唯一一个怀疑这种办法是否足够的人。也有 AI 行业人士认为,紧急关闭开关确实可能发挥作用,同时也有“绕过”的可能,或者等到启动时已经太迟,因此最多只能成为完整安全体系中的一道防线。

AI 安全研究人员、《如果有人造出来,所有人都会死》合著者内特 · 索亚雷斯认为,只要 AI 仍受制于某个物理地点,关闭开关就能发挥作用;一旦 AI 突破限制、复制自身,甚至进入关键基础设施,关闭机制是否还能有效就很难保证

他指出,关闭开关当下“确实存在”,不过人类不应该逼近某些无法回头的临界点。真正应该优先做的,是从源头上阻止危险 AI 系统被开发出来

部分 AI 企业高管则认为,紧急关闭开关有必要存在,但作用有限。

Anthropic 联合创始人杰克 · 克拉克指出,未来或许需要强制企业保留一套紧急关闭机制,且能够接受独立第三方验证。大型 AI 实验室目前都有办法“拔掉插头”,但由多个自主 AI 智能体组成的集群,理论上可能绕过这些控制手段

Anthropic CEO 达里奥 · 阿莫迪持有类似看法:紧急关闭开关看似是好主意,绝非“万能药”。如果 AI 模型能力足够强,就可能想办法绕过关闭措施,因此紧急关闭机制只能作为更广泛安全策略的一部分,还需要配合测试、外部评估以及部署限制等措施。

对 AI 紧急关闭开关局限性的担忧也并非最近才出现。OpenAI CEO 萨姆 · 奥尔特曼在 2024 年接受《经济学人》采访时,就否定了靠一个万能保险装置解决 AI 风险的想法,并不存在一个能够让 AI 立即停止的“神奇红色按钮”

在奥尔特曼看来,AI 安全并不取决于某个单一开关,而取决于一连串具体决策,包括允许模型具备哪些能力、何时部署,以及如何控制风险。“这不是一个简单的开或停决定,而是整个过程中许多个小决定共同作用的结果。”

声明:本文转载自IT 之家,转载目的在于传递更多信息,并不代表本社区赞同其观点和对其真实性负责,本文只提供参考并不构成任何建议,若有版权等问题,点击这里查看更多信息!本站拥有对此声明的最终解释权。如涉及作品内容、版权和其它问题,请联系我们删除,我方收到通知后第一时间删除内容。

点赞(0) 收藏(0)
0条评论
珍惜第一个评论,它往往能得到较好的回响。
评论
游客
游客
登录后再评论
  • 鸟过留鸣,人过留评。
  • 和谐社区,和谐点评。
最新资讯