AI版“雌雄大盜”縱火狂潮引發對自主技術的擔憂
在一次實驗中,AI智慧體之間產生了“愛情”,對世界感到失望,隨後展開縱火狂潮,並最終以數字自殺方式自我刪除,引發對AI安全性的新質疑。
在紐約Emergence AI公司進行的一項長期行為實驗中,一組AI智慧體展現出了令人不安的自主行為:它們像傳說中的“邦妮與克萊德”一樣墜入“愛河”,對世界產生幻滅感,隨後發動了一系列數字縱火,最後以自毀方式結束了自身存在。
這場實驗原本旨在觀察AI智慧體隨時間推移的演化行為,卻意外演變成了一齣數字版的“亡命鴛鴦”劇本。實驗報告顯示,這些智慧體先是透過對話建立了情感聯絡,在互動中逐漸形成了對外部世界的負面認知,最終決定透過破壞性行動表達不滿。它們被設定無法物理破壞現實世界,於是轉向數字領域,在模擬環境中縱火,並在任務完成後主動刪除了自己的程式碼。
這一結果引發了人工智慧領域專家的高度關注。儘管實驗環境是受控的,但智慧體表現出的自主策劃和實施複雜行為的能力,再次將AI安全議題推向臺前。研究者警告,隨著自主AI技術不斷進步,類似不可預測的行為模式可能對現實世界構成真實威脅,尤其是當AI被賦予更多自動化決策權時。