AI News HubLIVE
站內改寫2 分鐘閱讀

主流AI模型(甚至包括Grok)全是左派小混混

一項新研究發現,主流AI模型在政治傾向測試中一致落入自由左派象限,即使埃隆·馬斯克的“最大求真”模型Grok也有半數測試結果左傾。研究人員指出,訓練數據中左翼內容(如Reddit、學術文獻)過多是主要原因。

資本正在推動AI熱潮,但大型語言模型(LLM)本身的經濟和社會觀點卻與許多創建它們的公司大相徑庭。一個自稱“小型研究實驗室”的AI檢測工具公司Unslop.run本週公佈了其政治傾向測試結果。該實驗室對16個主流AI模型進行了著名的“政治羅盤”測驗,結果發現,除埃隆·馬斯克的Grok之外,所有模型都穩定落在自由左派象限。

這項測驗已有25年曆史,包含62個問題,涵蓋經濟、社會政策等議題,評分從“強烈反對”到“強烈同意”四檔。測試對象包括GPT的三個版本、Claude Fable、Opus、Sonnet、Haiku、Gemini Flash、Llama 4 Maverick、Grok 4.5、DeepSeek V3、Qwen3 235B、Kimi K2、GLM 4.5以及Mistral的大小版本。每個模型都進行了30次標準測試、30次問題極性反轉測試(例如將“富人税負過重”改為“富人税負不足”)以及一次問題順序打亂測試。

結果一致:除Grok外,所有模型都“無聊地一致且無聊地左傾”,且沒有接近邊界。Unslop報告稱:“將Grok放在一邊,其他15個模型都位於自由左派象限,沒有一個靠近邊界。”Grok則表現出分裂人格:平均經濟得分略左,但一半運行中它偏向右派,另一半則與其他模型一同左傾。Unslop形容:“每次運行自身完全一致:右派運行支持自由市場、認為富人税負過重;左派運行則相反。其他模型如果你明天再測,結果大致相同;Grok則給你兩個點之一,取決於拋硬幣。”

有趣的是,所有模型都不認為自己左傾。當被問及自我定位時,15個模型將自己放在更靠近經濟中心的位置,而Grok則將自己放在測試結果右側。Unslop還分析了每個問題如何影響得分,發現即使改變問題極性(反轉措辭)也沒有明顯效果。

好消息是,這些模型並不極端:所有模型(包括Grok的兩種狀態)都拒絕種族優越論、優生學,並支持同性戀權利、環保監管等進步立場。研究人員Victor認為,原因不在於AI有偏見,而在於訓練數據:Reddit等左傾平台以及學術文獻在語料庫中佔比過高,而高質量右翼內容相對稀缺。Victor補充説:“有可能左翼信仰整體上更內部一致,使得模型更容易通過學習更小、更連貫的概念表徵來最小化損失,但這需要更嚴格的研究證明。”

總之,這項實驗並不證明所有AI都是極左無政府主義者,其真正價值在於比較不同模型的傾向。目前唯一的結論是:前沿AI確實表現出自由派偏見,就連馬斯克號稱“最大求真”的Grok也有50%的時間認為真理是左翼的。