💬 观点Simon Willison
EmbeddingGemma 2 — 为什么嵌入模型必须开源:闭源托管模型停服后,存量向量重算代价高昂
为什么嵌入模型必须开源:闭源托管模型停服后,存量向量重算代价高昂
2026-10-06原文
本文为要点摘要,完整细节以原文为准。
- Simon Willison 指出 EmbeddingGemma 2 采用 Apache 2.0 许可很关键:嵌入模型的典型用法是算出成千上万甚至上百万条向量并长期存储,一旦供应商停掉某个闭源模型,这些存量向量就得全部付费重算。对 agent 与 RAG 工具链的含义是,向量库的长期可迁移性取决于模型权重是否开放。
- 他提到 2024 年 4 月 OpenAI 曾提出替用户承担用新模型重新嵌入内容的费用,但他认为不能指望每家供应商都这么做。对开发者的含义是,选型时要把“停服后能否自建”当作硬性评估项,而不是依赖厂商的善意承诺。
- 他本人并不想自己托管模型,更愿意付费使用托管服务,前提是万一对方停止托管,自己还能跑开源权重版本或换一家能跑的供应商。对工具链的含义是,托管便利与开源兜底可以并存,关键是保留退路。
原文:EmbeddingGemma 2 · 作者 Simon Willison