AI垃圾的前史
本文追溯了AI生成文本的早期历史,从1953年的Auto-Beatnik和Strachey的情书程序,到1957年乔姆斯基的“无色绿色想法狂怒地睡觉”,再到1960年代Lutz和Bense的诗歌生成。文章将当前AI生成内容的泛滥称为“AI垃圾洪水”,并引用预言中的“文本末日”,指出机器正以前所未有的速度淹没互联网。
本文探讨了AI生成内容(即“AI垃圾”)的悠长前史。早在1953年,数学家克里斯托弗·斯特雷奇(Christopher Strachey)就编写了一个程序,能自动生成类似“亲爱的,我的同情心美丽地吸引了你热情的喜爱”这样的情书。这种程序本质上是一种模板填空,随机抽取词库中的单词填充句子。同年,罗尔德·达尔(Roald Dahl)出版了小说《伟大的自动语法生成器》,讲述工程师阿道夫·尼普(Adolph Knipe)制造了一台能快速撰写廉价故事的机器,并预言这类机器将使一半以上的文学作品由机器生产。
1959年,威廉·S·巴罗斯(William S. Burroughs)开始试验“剪裁法”诗歌,随机拼接报纸短语。同时期,德国数学家西奥·卢茨(Theo Lutz)在Zuse Z22计算机上生成诗歌,从卡夫卡《城堡》中随机选取词语拼凑成句。1962年,哲学家马克斯·本斯(Max Bense)将这种创作称为“人工诗歌”,并试图区分自然诗和机器诗。1964年,蒙特利尔出版了据称是“第一部电子计算机创作的自由诗”,语句包括“苹果调整世界,但雨水因葡萄而美丽”。
这些早期实验在公众中引发了既恐慌又兴奋的反应。1961年,《生活》杂志警告“机器正在接管:计算机现在超越人类工作——很快可能比人类更聪明”。但当时许多报道对这种“机器写作”评价不高,要么认为它只是无意义的堆砌,要么认为它“几乎幼稚可笑”。
如今,AI生成的内容被称为“AI垃圾”,这个词汇被《韦氏词典》评为2025年度词汇。据数字营销机构Graphite统计,2024年秋季,网络上约一半的英语文章由机器撰写,而ChatGPT出现前这个比例不到2%。YouTube、Reddit、Facebook等平台被AI内容淹没。文学评论家马修·基尔申鲍姆(Matthew Kirschenbaum)警告即将到来的“文本末日”,认为届时人类撰写的文档将成为稀有古董。
文章将AI垃圾的泛滥比作1919年波士顿的糖蜜洪灾——一场巨大的糖蜜波以35英里/小时的速度席卷城市,清理工作持续数周,连地铁站都粘乎乎的。同样,AI生成的内容具有“甜蜜”的粘性,但它们并不甜美,反而令人窒息。作者讽刺道,尽管有人断言2026年将是“AI垃圾清洗”的开始,但这一承诺并不可靠,因为“我的鳀鱼依然悲伤”。