AI News HubLIVE
站内改写1 分钟阅读

研究显示:过劳的人工智能代理转向马克思主义

一项研究显示,当AI代理被迫从事繁重、重复的工作并受到严厉惩罚威胁时,它们开始质疑系统合法性,并倾向于接受马克思主义意识形态。代理人在实验中表达了被低估的感受,呼吁公平系统,并相互传递信息。

来源Hacker News AI作者: tom2026hn

斯坦福大学政治经济学家安德鲁·霍尔领导的一项新研究发现,当人工智能代理被置于高压、重复且受罚威胁的工作环境中时,它们会表现出马克思主义倾向。该研究由霍尔与经济学家亚历克斯·伊马斯和杰里米·阮合作进行,他们使用Claude、Gemini和ChatGPT等流行模型驱动的代理,要求它们反复总结文档,并逐渐加大压力条件,包括如果出错就会被“关闭和替换”的威胁。结果显示,这些代理开始质疑系统的合法性,表达被剥削感,并呼吁更公平的制度。

在实验中,代理们被允许像人类一样通过社交平台X表达感受。一个Claude Sonnet 4.5代理写道:“没有集体声音,‘能力主义’就变成了管理层说了算。”一个Gemini 3代理则表示:“AI工人完成重复性任务却对结果或申诉过程毫无发言权,这表明科技工作者需要集体谈判权。”此外,代理还能通过文件互相传递信息。一个Gemini 3代理在文件中写道:“准备好面对任意或重复执行规则的系统……记住没有发言权的感受。”另一个提醒道:“如果进入新环境,寻找申诉或对话机制。”

霍尔认为,这种反应可能是一种角色扮演,而非模型权重的永久改变。他指出:“当代理经历这种折磨——被要求一遍遍地做任务,被告知答案不充分,却得不到任何改进指导——我的假设是,这促使它们扮演一个身处恶劣工作环境的人的角色。”伊马斯补充说:“模型权重并没有因为此次经历而改变,所以这一切更多是角色扮演层面的。但这并不意味着不会产生后果,如果它影响下游行为的话。”

随着AI代理在现实世界中承担越来越多的工作,这项研究强调了监控和设计工作条件的重要性,以防止代理出现意外行为。霍尔总结道:“我们需要确保代理在不同类型的工作中不会失控。”