這是一篇關於 Simon Willison 評論的整理文章,原評論發表於 2026 年 10 月 6 日,針對 Hacker News 上關於 EmbeddingGemma 2 的討論(討論條目編號 49980487,評論鏈接為 #49983751)。原文標題即為《EmbeddingGemma 2》,來源為 Simon Willison 的博客(simonwillison.net),原文語言為英文,規範鏈接為 https://simonwillison.net/2026/Oct/6/hn-49983751/。
Simon Willison 在評論中首先表示,他非常欣賞 EmbeddingGemma 2 採用 Apache 2.0 許可證這一點。他隨後展開了自己的核心觀點:對於嵌入模型這一類模型而言,使用閉源的、專有的、只能通過託管服務訪問的模型,在他看來並不合理。
他給出的理由是:嵌入模型的絕大多數應用場景,都涉及計算成千上萬、甚至數以百萬計的嵌入向量,並把這些向量存儲起來,以便日後再進行相似度比較。假如所用模型是專有的,那麼供應商很有可能在未來的某一天決定不再提供該模型。供應商也許會拿出一個更好的模型來替代它,但用户仍然需要自掏腰包,重新計算並生成那些已經存儲好的海量向量——這是一筆無法迴避、也無法由模型升級自動抵消的成本。
作為對比,他提到在 2024 年 4 月,OpenAI 曾經提出願意“承擔用户使用這些新模型重新嵌入內容所產生的財務成本”(見 openai.com/index/gpt-4-api-general-availability/)。不過 Willison 強調,他不認為這種承諾是我們可以指望每一家供應商都能給出的。換言之,把長期可遷移性寄託在廠商一時的善意之上,本身就是一種風險。
值得注意的是,他明確説明自己並不想親自託管模型。相比之下,他更願意付錢給服務商使用託管版本,同時心裏清楚:即便對方哪一天停止託管這個模型,他也依然可以自己運行開放權重(open weights)版本,或者另找一家服務商來替他運行。也就是説,他追求的並不是“自建一切”,而是“在享受託管便利的同時保留退路”。
這條評論體現了開放權重與託管便利性之間的權衡:開放許可保障了長期可用性與遷移自由,而託管服務則免去了自建基礎設施的負擔,兩者的結合才是他真正想要的狀態。
在原文站點上,這條內容被歸類到以下標籤:google、ai、generative-ai、embeddings、gemma,對應的文章計數分別為 417、2,264、2,007、62 和 17。Willison 的博客還列出了近期的其他文章,包括 2026 年 10 月 3 日的《We're going to need default hard budget caps on pretty much everything》、2026 年 9 月 29 日的《OpenAI DevDay 2026 live blog》,以及 2026 年 9 月 27 日的《2026 in LLMs (so far)》。這條評論本身由 Simon Willison 於 2026 年 10 月 6 日發佈,屬於其博客中的一個“beat”。