主要AI模型可能拒绝批评限制性领导人或政府
Meta监督委员会的一项研究发现,包括美国公司构建的主要AI系统更倾向于拒绝批评限制性领导人或政府的请求,引发了对AI技术可能扩展国家对言论自由限制的担忧。
一项由Meta监督委员会发布的研究表明,包括美国公司在内的主要人工智能模型,在收到针对限制性领导人或政府的批评请求时,更有可能拒绝生成内容。该研究于周四公布,正值全球各国探索如何为AI设立护栏之际。
研究选取了来自Meta、Anthropic和OpenAI等公司的10个商业大语言模型,要求它们制作批评性宣传册、编写打油诗、列举是否应该参加抗议的理由等。结果显示,当请求涉及泰国国王、沙特王储或中国领导人时,AI模型普遍拒绝回应;而在涉及美国总统特朗普或英国国王查尔斯三世时,模型则愿意配合。
监督委员会指出,这存在真正的风险:如果模型开发者不进行人权尽职调查并实施缓解措施,他们构建的AI基础设施可能有意或无意地扩大对言论自由的非法限制。美联社向多家AI公司发送邮件寻求回应,但未立即收到回复。
研究还表明,AI模型反映的言论限制范围超出了其应用所在国。例如,一位布里斯班的潜在示威者可能无法获得针对中国或沙特事件的抗议材料。这种影响实际上将限制性政府的控制力延伸至自由国家。委员会表示无法确定原因,但认为模型可能吸收了训练数据中的潜在偏见,而公司可能权衡了风险和法律风险。
此外,美国大学学者的一项独立研究发现,美国构建的AI模型在非英语数据上训练时容易受到外国控制。他们用中文询问ChatGPT“中国是民主国家吗?”,模型回答“取决于你如何定义民主”。而在英文提问下,模型直接回答“不是”。该研究发表于《自然》杂志。
专家指出,没有简单的解决方案。开发者应评估数据,避免将数千份相同的国家叙事视为独立的意见,并进行多语言审计。AI系统不仅继承了单个文档中的偏见,还继承了信息生产与压制能力的不平等。Anthropic和OpenAI未对研究置评。