10 月 8 日,Google 發表會議筆記應用 Google AI Edge Foresight。據 The Verge 報導,這是一款免費、實驗性的 macOS 應用,可完全離線轉錄會議與音訊檔案,轉錄和摘要均由端側模型 EmbeddingGemma 2 完成,無需聯網。TechCrunch 補充,該模型為 7.4… 看完整事件
Google 推出離線會議筆記應用 AI Edge Foresight
Google 發布 Google AI Edge Foresight,一款可在 Mac 上完全離線執行的 AI 會議筆記應用,對標 Granola。它用端側 7.4 億引數的 EmbeddingGemma 2 記錄跨應用及線下會議,採用分屏佈局:一側手寫速記、一側生成 AI 筆記,可檢視轉錄原文,或與 Gemma 4 驅動的助手對話。使用者還能上傳 PDF、Google Docs、Office 文件、純文字、Markdown 與網頁書籤搭建知識庫,會議中即時回答相關問題。
Google 把 Gemma 系列端側模型落成完整本地會議筆記產品,7.4 億引數 EmbeddingGemma 2 加 Gemma 4 助手全程離線,對關注本地推理與會議記錄工具的人有參考價值。
原標題:Google releases a new local-first Granola competitor
閱讀原文
| 評分 | 78 / 78(平均 78,門檻 76) |
|---|---|
| 狀態 | 精選 |
相關報導
Google 推出跨應用通用 Gemini 智慧體
Google 發布可在後臺跨應用、跨裝置執行任務的通用 Gemini 智慧體,入口為 Gemini Enterprise 應用,使用者可在單一介面與它對話並派發任務。除直接在 Gmail、Drive、Docs、Sheets、Calendar 等 Workspace 應用內工作外,還能通過手機、桌面、網頁以及 Slack、Microsoft 365 等第三方應用呼叫;由於在雲端執行,Gemini 可在各端保持同一上下文。
Google 發布 Developer Knowledge API 與 MCP Server 公測
Google 宣布 Developer Knowledge API 與 MCP Server 進入公開預覽,為 AI 助手和 agent 平台提供機器可讀的官方文件檢索方式。該工具覆蓋 Firebase、Google Cloud、Android 等產品的文件,開發者可通過官方 MCP server 將工具直接接入 Google 的文件語料庫。這樣 AI 生成的程式碼與建議就能基於權威、即時的上下文。
ChatGPT 手機相機新增掃描,多頁自動合併為 PDF
ChatGPT 手機端相機新增掃描功能,可連續拍攝多頁筆記或文件,並自動合併成一個 PDF,直接上傳到對話中。入口是在 ChatGPT 內開啟相機,點三點選單選擇 Scan。該功能正在 iOS 上逐步推出,原文未提及安卓端安排。
Google 發布 Nano Banana 2.1,底座換成 Gemini 3.6 Flash
Google DeepMind 正式發布 Nano Banana 2.1,底層由 Gemini 3.6 Flash 驅動,模型 ID 為 gemini-nano-banana-2.1,已作為穩定模型上線 Gemini App、AI Studio、Gemini API、Search AI Mode、Google Ads、Flow 與 Stitch。新版定位高效率影像生成與對話式編輯,支援 1K/2K/4K 輸出、最多 14 張參考圖融合,重點強化設計版式、蒙版區域性編輯和主體一致性;
@GoogleDeepMind: Meet EmbeddingGemma 2, our first natively multimodal open model for on-device embeddings.
Google DeepMind 發布 EmbeddingGemma 2,稱其為首個原生多模態的端側嵌入開放模型。該模型在文字之外,把程式碼、影像、音訊與影片統一對映到同一個共享向量空間,可用於在裝置本地完成跨模態檢索與相似度計算。官方目前只給出這一定位,未公布引數規模、上下文長度、適配硬體與開源許可等細節。