关于“超级智能 AI 是否会灭绝人类”的讨论,近来在 AI 行业内部变得越来越直白,甚至开始以概率的形式公开表达。卫报发表的这篇评论文章,正是从行业内部的一次人事变动切入这一话题。
文章指出,本月早些时候,AI 研究员 Jacob Coxon 在加入 Anthropic 仅四个月后选择辞职。他在 X 上发布的声明中写道:“构建 AI 的人真心相信,它可能在这个十年结束前杀死我们所有人。”这并非一句情绪化的个人感慨——Anthropic 的资深员工 Evan Hubinger 对 Coxon 的判断表示认同,并补充说,他个人认为这种情况在未来十年内发生的概率超过 10%。
作者、AI 研究者托比·沃尔什由此提出一个更直接的问题:如果认真做最坏情况的推演,AI 究竟会通过哪些路径导致人类灭绝?文章给出的答案并不是单一的“机器人造反”,而是涵盖多种截然不同的机制,从危险的新型生物武器,到整个社会秩序的崩溃。
这些情景的共同点在于,它们并不要求 AI 具备科幻式的“恶意”,而更多来自能力失控、竞争压力与社会系统脆弱性相互叠加的结果。文章的意义或许不在于预言,而在于提醒公众与政策制定者:前沿 AI 实验室内部对风险的担忧正在上升,而这种担忧与他们继续加速研发的现实之间存在明显张力。