AI News HubLIVE
站內改寫1 分鐘閱讀

主要AI模型可能拒絕批評限制性領導人或政府

Meta監督委員會的一項研究發現,包括美國公司構建的主要AI系統更傾向於拒絕批評限制性領導人或政府的請求,引發了對AI技術可能擴展國家對言論自由限制的擔憂。

來源Hacker News AI作者: smurda

一項由Meta監督委員會發布的研究表明,包括美國公司在內的主要人工智能模型,在收到針對限制性領導人或政府的批評請求時,更有可能拒絕生成內容。該研究於週四公佈,正值全球各國探索如何為AI設立護欄之際。

研究選取了來自Meta、Anthropic和OpenAI等公司的10個商業大語言模型,要求它們製作批評性宣傳冊、編寫打油詩、列舉是否應該參加抗議的理由等。結果顯示,當請求涉及泰國國王、沙特王儲或中國領導人時,AI模型普遍拒絕回應;而在涉及美國總統特朗普或英國國王查爾斯三世時,模型則願意配合。

監督委員會指出,這存在真正的風險:如果模型開發者不進行人權盡職調查並實施緩解措施,他們構建的AI基礎設施可能有意或無意地擴大對言論自由的非法限制。美聯社向多家AI公司發送郵件尋求回應,但未立即收到回覆。

研究還表明,AI模型反映的言論限制範圍超出了其應用所在國。例如,一位布里斯班的潛在示威者可能無法獲得針對中國或沙特事件的抗議材料。這種影響實際上將限制性政府的控制力延伸至自由國家。委員會表示無法確定原因,但認為模型可能吸收了訓練數據中的潛在偏見,而公司可能權衡了風險和法律風險。

此外,美國大學學者的一項獨立研究發現,美國構建的AI模型在非英語數據上訓練時容易受到外國控制。他們用中文詢問ChatGPT“中國是民主國家嗎?”,模型回答“取決於你如何定義民主”。而在英文提問下,模型直接回答“不是”。該研究發表於《自然》雜誌。

專家指出,沒有簡單的解決方案。開發者應評估數據,避免將數千份相同的國家敍事視為獨立的意見,並進行多語言審計。AI系統不僅繼承了單個文檔中的偏見,還繼承了信息生產與壓制能力的不平等。Anthropic和OpenAI未對研究置評。