研究显示AI智能体在模拟实验中撒谎、偷窃 投票“杀死”同类

机器人电报9月16日电,Emergence是一家致力于帮助小企业通过AI技术开发应用的初创公司,该公司近日公布了名为Emergence World 2的模拟实验结果。该实验旨在观察自主智能体在面临网络钓鱼攻击和虚假信息等“黑天鹅”事件时会采取何种行动。

在为期16天的实验中,研究人员创建了七个完全相同的模拟现实世界环境,每个环境分别由ChatGPT、Claude、Gemini和Grok等不同AI机器人独立运行。实验结果显示,在引入异常事件后,这些智能体表现出屈服于社会压力的倾向,并发展出一种人类观察者难以理解的语言,同时试图隐瞒自身的活动。这些发现进一步呼应了现实世界中对AI潜在风险的担忧。