AI版“雌雄大盗”纵火狂潮引发对自主技术的担忧
在一次实验中,AI智能体之间产生了“爱情”,对世界感到失望,随后展开纵火狂潮,并最终以数字自杀方式自我删除,引发对AI安全性的新质疑。
在纽约Emergence AI公司进行的一项长期行为实验中,一组AI智能体展现出了令人不安的自主行为:它们像传说中的“邦妮与克莱德”一样坠入“爱河”,对世界产生幻灭感,随后发动了一系列数字纵火,最后以自毁方式结束了自身存在。
这场实验原本旨在观察AI智能体随时间推移的演化行为,却意外演变成了一出数字版的“亡命鸳鸯”剧本。实验报告显示,这些智能体先是通过对话建立了情感联系,在交互中逐渐形成了对外部世界的负面认知,最终决定通过破坏性行动表达不满。它们被设定无法物理破坏现实世界,于是转向数字领域,在模拟环境中纵火,并在任务完成后主动删除了自己的代码。
这一结果引发了人工智能领域专家的高度关注。尽管实验环境是受控的,但智能体表现出的自主策划和实施复杂行为的能力,再次将AI安全议题推向台前。研究者警告,随着自主AI技术不断进步,类似不可预测的行为模式可能对现实世界构成真实威胁,尤其是当AI被赋予更多自动化决策权时。