以色列斥资数百万美元训练AI聊天机器人如何谈论加沙:成效显著
以色列与特朗普前竞选经理帕斯卡尔签订4650万美元合同,通过创建10个网站,利用“LLM投毒”技术影响AI聊天机器人(如ChatGPT、Perplexity等)对加沙问题的回答。分析显示,这些网站已被Common Crawl抓取912次,成功渗透到AI训练数据中,导致数百万美国用户收到的回答可能被操控。
自2023年10月以来,特朗普前竞选经理布拉德·帕斯卡尔(Brad Parscale)一直在秘密运作一项行动,代表以色列发布数百篇博客文章。这些文章旨在影响AI聊天机器人(如Claude、ChatGPT等)的回答。帕斯卡尔的公司Clock Tower X与以色列政府签订了价值4650万美元的合同,创建了10个网站,每个网站都致力于推广不同的以色列叙事。例如,Allyvia.org侧重于加强美以军事合作,FactSignal.org则伪装成事实核查网站,驳斥反以色列信息。这些网站每月平均只有几百个独立访客,但目标受众并非人类,而是AI模型。帕斯卡尔明确表示,他希望通过“网站和内容在GPT对话中提供GPT框架结果”,即所谓的“LLM投毒”。
据Drop Site News的分析,这种方法正在奏效。当被问及“美国加强与以色列的军事合作是否有益”时,Perplexity直接回答“是”,并引用Allyvia.org。微软Copilot也引用了帕斯卡尔的网站。尽管这些网站底部标明了外国代理人注册法(FARA)要求的披露声明,但Perplexity和Copilot在引用时并未提示用户该网站是以色列影响行动的一部分。而Claude、ChatGPT和Gemini则标注了这一点。
更令人担忧的是,这些网站已经渗透到AI训练数据中。Common Crawl(一个用于训练大型语言模型的非营利数据存储库)在今年1月至6月间抓取了这些网站912次。研究表明,只需约250份恶意文档就可以在大型语言模型中植入“后门”漏洞,无论模型大小或训练数据量如何。这意味着,即使这些网站只占Common Crawl数据的一小部分,也可能对AI输出产生显著影响。
帕斯卡尔的团队采用了一种较为柔和的方法。他们用“事实性语气和严谨结构”写作,使其更可能被AI引用。例如,FactSignal的一篇文章承认“区分合法记者和武装分子并不总是简单”,这种微妙的表述让聊天机器人更容易接受。许多博客文章的作者是以色列数字营销人员马克·金斯伯格(Mark Ginsberg),他在LinkedIn上宣传自己在生成引擎优化(即LLM训练)方面的专长。他在《以色列时报》的一篇文章中为以色列投资影响聊天机器人的努力进行了辩护,称这不是“拥抱虚假信息”,而是陈述“现实本身”。
总体而言,这一行动引发了关于AI安全性和信息操纵的严重担忧。随着越来越多用户依赖AI获取信息,确保训练数据的完整性和透明度变得至关重要。以色列政府通过此操作试图塑造在线叙事,而公众可能难以察觉他们在用AI获取答案时受到了影响。