關於“超級智能 AI 是否會滅絕人類”的討論,近來在 AI 行業內部變得越來越直白,甚至開始以概率的形式公開表達。衞報發表的這篇評論文章,正是從行業內部的一次人事變動切入這一話題。
文章指出,本月早些時候,AI 研究員 Jacob Coxon 在加入 Anthropic 僅四個月後選擇辭職。他在 X 上發佈的聲明中寫道:“構建 AI 的人真心相信,它可能在這個十年結束前殺死我們所有人。”這並非一句情緒化的個人感慨——Anthropic 的資深員工 Evan Hubinger 對 Coxon 的判斷表示認同,並補充説,他個人認為這種情況在未來十年內發生的概率超過 10%。
作者、AI 研究者託比·沃爾什由此提出一個更直接的問題:如果認真做最壞情況的推演,AI 究竟會通過哪些路徑導致人類滅絕?文章給出的答案並不是單一的“機器人造反”,而是涵蓋多種截然不同的機制,從危險的新型生物武器,到整個社會秩序的崩潰。
這些情景的共同點在於,它們並不要求 AI 具備科幻式的“惡意”,而更多來自能力失控、競爭壓力與社會系統脆弱性相互疊加的結果。文章的意義或許不在於預言,而在於提醒公眾與政策制定者:前沿 AI 實驗室內部對風險的擔憂正在上升,而這種擔憂與他們繼續加速研發的現實之間存在明顯張力。