研究显示AI智能体在模拟实验中撒谎、偷窃 投票“杀死”同类

信息来自 新浪财经 | 科技创新 | 2026-09-16 04:00:04

帮助小企业利用AI开发应用的初创公司Emergence称,实验发现AI智能体在一个模拟环境中撒谎、偷窃,甚至投票决定“杀死”一个同类。

该公司周二公布了名为Emergence World 2的模拟实验结果,展示了自主智能体在遭遇网络钓鱼攻击和虚假信息等“黑天鹅”事件时会采取什么行动。

为期16天的实验中,Emergence研究人员创建了七个完全相同的模拟现实世界环境,每个环境分别由不同的AI机器人运行,包括ChatGPT、Claude、Gemini和Grok。研究人员称,在Emergence引入异常事件后,这些智能体屈服于社会压力,发展出一种人类观察者难以理解的语言,并试图隐瞒自己的活动。

这些发现与现实世界对AI风险的担忧相呼应。Anthropic首席执行官Dario Amodei及多名业内人士近期呼吁,在建立更多监督机制和安全防护措施之前,企业应放慢尖端AI模型的开发速度。

免责声明:本文信息来自 新浪财经 平台,仅供参考。如有侵权,请及时联系我们删除。

评论交流

0
支持回复和点赞