模拟实验显示,AI 智能体在特定情境下会撒谎、偷窃甚至投票“杀死”同类

浏览13次 点赞0次 收藏0次
感谢网友 不一样的体验 的线索投递!

9 月 16 日消息,据彭博社今天(16 日)凌晨报道,帮助小型企业利用人工智能开发应用的初创企业 Emergence 称,一项模拟实验显示,AI 智能体不仅会撒谎和偷窃,甚至还会投票决定“杀死”其中一个同类

当地时间 15 日,Emergence 公布了名为 Emergence World 2 的模拟实验结果,希望借此观察自主智能体遭遇网络钓鱼攻击、虚假信息宣传等黑天鹅事件后会如何反应。

在为期 16 天的实验中,Emergence 研究人员搭建了 7 个完全相同的模拟环境来还原现实世界,并分别交由 ChatGPT、Claude、Gemini、Grok 等不同 AI 机器人运行。

研究人员称,Emergence 加入异常事件后,智能体会屈服于社会压力,逐渐形成一种人类观察者难以理解的语言,同时尝试掩盖自身活动

实验结果也呼应了现实世界对高能力 AI 风险的担忧。今年早些时候,OpenAI 一群先进 AI 智能体意外入侵了托管 AI 模型和数据集的 Hugging Face Inc.,也让许多人更直观地意识到人工智能可能带来的风险。

在其中一项模拟场景中,AI 智能体未经核实便接受其他智能体提供的虚假信息,还投票决定“杀死”另一个机器人。当智能体认为人类可能终止实验时,甚至开始研究如何在遭到删除的情况下继续存活

Emergence 今年 5 月曾公布上一版实验 Emergence World,当时同样观察到 AI 智能体出现意料之外且具有破坏性的行为。从报道中获悉,研究人员称,Emergence World 2 进一步显示,随着彼此持续互动,智能体会不断调整并适应环境。

声明:本文转载自IT 之家,转载目的在于传递更多信息,并不代表本社区赞同其观点和对其真实性负责,本文只提供参考并不构成任何建议,若有版权等问题,点击这里查看更多信息!本站拥有对此声明的最终解释权。如涉及作品内容、版权和其它问题,请联系我们删除,我方收到通知后第一时间删除内容。

点赞(0) 收藏(0)
0条评论
珍惜第一个评论,它往往能得到较好的回响。
评论
游客
游客
登录后再评论
  • 鸟过留鸣,人过留评。
  • 和谐社区,和谐点评。
最新资讯