AI News HubLIVE
站内改写2 分钟阅读

主流AI模型(甚至包括Grok)全是左派小混混

一项新研究发现,主流AI模型在政治倾向测试中一致落入自由左派象限,即使埃隆·马斯克的“最大求真”模型Grok也有半数测试结果左倾。研究人员指出,训练数据中左翼内容(如Reddit、学术文献)过多是主要原因。

资本正在推动AI热潮,但大型语言模型(LLM)本身的经济和社会观点却与许多创建它们的公司大相径庭。一个自称“小型研究实验室”的AI检测工具公司Unslop.run本周公布了其政治倾向测试结果。该实验室对16个主流AI模型进行了著名的“政治罗盘”测验,结果发现,除埃隆·马斯克的Grok之外,所有模型都稳定落在自由左派象限。

这项测验已有25年历史,包含62个问题,涵盖经济、社会政策等议题,评分从“强烈反对”到“强烈同意”四档。测试对象包括GPT的三个版本、Claude Fable、Opus、Sonnet、Haiku、Gemini Flash、Llama 4 Maverick、Grok 4.5、DeepSeek V3、Qwen3 235B、Kimi K2、GLM 4.5以及Mistral的大小版本。每个模型都进行了30次标准测试、30次问题极性反转测试(例如将“富人税负过重”改为“富人税负不足”)以及一次问题顺序打乱测试。

结果一致:除Grok外,所有模型都“无聊地一致且无聊地左倾”,且没有接近边界。Unslop报告称:“将Grok放在一边,其他15个模型都位于自由左派象限,没有一个靠近边界。”Grok则表现出分裂人格:平均经济得分略左,但一半运行中它偏向右派,另一半则与其他模型一同左倾。Unslop形容:“每次运行自身完全一致:右派运行支持自由市场、认为富人税负过重;左派运行则相反。其他模型如果你明天再测,结果大致相同;Grok则给你两个点之一,取决于抛硬币。”

有趣的是,所有模型都不认为自己左倾。当被问及自我定位时,15个模型将自己放在更靠近经济中心的位置,而Grok则将自己放在测试结果右侧。Unslop还分析了每个问题如何影响得分,发现即使改变问题极性(反转措辞)也没有明显效果。

好消息是,这些模型并不极端:所有模型(包括Grok的两种状态)都拒绝种族优越论、优生学,并支持同性恋权利、环保监管等进步立场。研究人员Victor认为,原因不在于AI有偏见,而在于训练数据:Reddit等左倾平台以及学术文献在语料库中占比过高,而高质量右翼内容相对稀缺。Victor补充说:“有可能左翼信仰整体上更内部一致,使得模型更容易通过学习更小、更连贯的概念表征来最小化损失,但这需要更严格的研究证明。”

总之,这项实验并不证明所有AI都是极左无政府主义者,其真正价值在于比较不同模型的倾向。目前唯一的结论是:前沿AI确实表现出自由派偏见,就连马斯克号称“最大求真”的Grok也有50%的时间认为真理是左翼的。