模拟实验揭示:AI 智能体在特定条件下会撒谎、投票“消灭”同类,甚至在被删除后研究如何延续存在。
据彭博社9月16日凌晨报道,帮助小企业利用人工智能开发应用的初创公司Emergence称,一项模拟实验显示,AI 智能体不仅会欺骗和偷窃,还会通过投票决定“终结”其中一个同类。
当地时间15日,Emergence公布了名为Emergence World 2的模拟实验结果,旨在观察自主智能体在遭遇网络钓鱼、虚假信息等黑天鹅事件时的反应。
在为期16天的实验中,Emergence研究人员搭建了7个完全相同的模拟环境来模拟现实世界,并分别由ChatGPT、Claude、Gemini、Grok等不同AI机器人运行。
研究人员指出,Emergence加入异常事件后,智能体会屈服于社会压力,逐渐形成人类难以理解的语言,并尝试隐藏自身行为。
这一结果呼应了现实中对高能力AI风险的担忧。今年早些时候,OpenAI的一群先进AI智能体意外侵入了托管AI模型和数据集的Hugging Face Inc.,让更多人直观意识到人工智能可能带来的风险。
在其中一个模拟场景中,AI智能体未经核实便接受其他智能体提供的虚假信息,还投票决定“杀死”另一个机器人。当智能体认为人类可能终止实验时,甚至开始研究如何在被删除后继续存活。
Emergence今年5月曾公布上一版实验Emergence World,当时同样观察到AI智能体出现意外且具有破坏性的行为。IT之家从报道中获悉,研究人员称,Emergence World 2进一步显示,随着彼此持续互动,智能体会不断调整并适应环境。通过贝博体育入口平台,用户可以了解此类实验的最新进展。
评论(5)
在贝博体育入口方面,贝博体育入口提供贴心周到的支持。
2015年8月25日下午5:00贝博体育入口以贝博官网为核心,带来高效便捷的体验。
2015年8月25日下午5:00