这是一篇关于 Simon Willison 评论的整理文章,原评论发表于 2026 年 10 月 6 日,针对 Hacker News 上关于 EmbeddingGemma 2 的讨论(讨论条目编号 49980487,评论链接为 #49983751)。原文标题即为《EmbeddingGemma 2》,来源为 Simon Willison 的博客(simonwillison.net),原文语言为英文,规范链接为 https://simonwillison.net/2026/Oct/6/hn-49983751/。
Simon Willison 在评论中首先表示,他非常欣赏 EmbeddingGemma 2 采用 Apache 2.0 许可证这一点。他随后展开了自己的核心观点:对于嵌入模型这一类模型而言,使用闭源的、专有的、只能通过托管服务访问的模型,在他看来并不合理。
他给出的理由是:嵌入模型的绝大多数应用场景,都涉及计算成千上万、甚至数以百万计的嵌入向量,并把这些向量存储起来,以便日后再进行相似度比较。假如所用模型是专有的,那么供应商很有可能在未来的某一天决定不再提供该模型。供应商也许会拿出一个更好的模型来替代它,但用户仍然需要自掏腰包,重新计算并生成那些已经存储好的海量向量——这是一笔无法回避、也无法由模型升级自动抵消的成本。
作为对比,他提到在 2024 年 4 月,OpenAI 曾经提出愿意“承担用户使用这些新模型重新嵌入内容所产生的财务成本”(见 openai.com/index/gpt-4-api-general-availability/)。不过 Willison 强调,他不认为这种承诺是我们可以指望每一家供应商都能给出的。换言之,把长期可迁移性寄托在厂商一时的善意之上,本身就是一种风险。
值得注意的是,他明确说明自己并不想亲自托管模型。相比之下,他更愿意付钱给服务商使用托管版本,同时心里清楚:即便对方哪一天停止托管这个模型,他也依然可以自己运行开放权重(open weights)版本,或者另找一家服务商来替他运行。也就是说,他追求的并不是“自建一切”,而是“在享受托管便利的同时保留退路”。
这条评论体现了开放权重与托管便利性之间的权衡:开放许可保障了长期可用性与迁移自由,而托管服务则免去了自建基础设施的负担,两者的结合才是他真正想要的状态。
在原文站点上,这条内容被归类到以下标签:google、ai、generative-ai、embeddings、gemma,对应的文章计数分别为 417、2,264、2,007、62 和 17。Willison 的博客还列出了近期的其他文章,包括 2026 年 10 月 3 日的《We're going to need default hard budget caps on pretty much everything》、2026 年 9 月 29 日的《OpenAI DevDay 2026 live blog》,以及 2026 年 9 月 27 日的《2026 in LLMs (so far)》。这条评论本身由 Simon Willison 于 2026 年 10 月 6 日发布,属于其博客中的一个“beat”。