2026 年 10 月 6 日,Google DeepMind 發布開源多模態嵌入模型 EmbeddingGemma 2,以 Apache 2.0 許可開放商用,權重已上線 Hugging Face 與 Kaggle。該模型 740M 引數,把文字、程式碼、影像、音訊與影片對映到統一的 768 維向量空間,採用模組化編… 看完整事件
Google 發布 EmbeddingGemma 2,統一五種模態嵌入
Google 發布 EmbeddingGemma 2,一個把文字、程式碼、影像、影片和音訊對映到同一嵌入空間的多模態嵌入模型。它採用 740M 引數與模組化編碼器,面向端側場景最佳化;藉助 Matryoshka 表示學習支援 768 到 128 維的靈活維度,上下文視窗 8K,是純文字版 EmbeddingGemma 的 4 倍,並以 Apache 2.0 許可開放商用。
端側嵌入模型此前多限於文字或影像,EmbeddingGemma 2 以 740M 引數把五種模態併入同一空間並開放商用,對做本地多模態檢索的開發者有直接參考價值。
原標題:Google EmbeddingGemma 2
閱讀原文
| 評分 | 78 / 78(平均 78,門檻 76) |
|---|---|
| 狀態 | 精選 |
相關報導
Google 取消 Gemini Flash 與 Pro 模型免費使用
Google 將停止 Gemini Flash 和 Pro 模型的免費使用,使用者需付費訂閱才能繼續使用。此舉在 r/GeminiAI 社群引發大量討論,使用者對 Flash 被納入付費範圍尤為不滿,認為 Flash-Lite 能力不足。部分使用者表示將轉向 ChatGPT、Claude 或 DeepSeek 等替代方案。
Gemini 4 Argon 發布:輸出上限 1M token,限網路安全預覽
Google DeepMind 發布 Gemini 4 Argon,主打程式設計、企業知識工作與網路防禦,在 19 項基準中 13 項達到 SOTA,並首次實現最高 1M token 輸出(Long Decode Continuation 跨呼叫續寫)。目前僅面向政府使用者與 Fairwind 計劃中的可信網路安全人員開放,開發者、企業與消費者訪問時間未定。標準定價為每百萬輸入/輸出 token 4/20 美元,五折優惠後 2/10 美元,快取輸入再降 95%。