Simon Willison·· 1 天前AI 评分44
EmbeddingGemma 2 采用 Apache 2.0,嵌入模型不宜只用闭源托管
EmbeddingGemma 2
AI 导读
Simon Willison看重EmbeddingGemma 2采用Apache 2.0,认为嵌入模型不宜闭源专有且仅能托管。嵌入模型的多数应用要计算数千甚至数百万条嵌入向量,并存下来供日后比较。
正文 · AI 翻译
6th October 2026
我真的很欣赏 EmbeddingGemma 2 采用 Apache 2.0 许可证。
尤其是对于嵌入模型,我认为使用封闭、专有、仅限托管的模型并不合理。
嵌入模型的大多数应用都涉及计算数千甚至数百万个嵌入向量,并将它们存储起来以供日后比较。
如果你的模型是专有的,供应商很可能有一天会决定停止提供该模型。他们会有更好的模型来取代它,但你仍然需要付费重新计算那数百万个已存储的现有向量。
(In April 2024,OpenAI 提出“承担用户使用这些新模型重新嵌入内容的财务成本”——https://openai.com/index/gpt-4-api-general-availability/——但我认为这并非我们可以指望每个提供商都会做的事。)
值得注意的是,我并不想自己托管模型。我更愿意向提供商付费使用托管模型,同时知道如果他们停止托管,我可以自己运行开放权重版本——或者另找一家能为我做到这一点的供应商。
来源:Simon Willison · simonwillison.net