Gemini Nano Banana 2.1 影像模型正式可用
Google 將 Gemini Nano Banana 2.1(gemini-nano-banana-2.1)轉為正式可用(GA),這是繼 Nano Banana 2(gemini-3.1-flash-image)之後的影像生成與對話式編輯模型。它在保持 Flash 級速度與成本的同時,提升了視覺品質、提示詞遵循、多輪角色一致性、文字渲染,並支援 1:4、4:1、1:8、8:1 的寬幅與全景比例,輸出覆蓋 1K、2K、4K 解析度。
官方確認 Nano Banana 2.1 轉 GA,並給出舊影像模型 10 月 29 日的關停日期,使用 Gemini 影像 API 的開發者需要據此安排遷移與比例、解析度適配。
原標題:Gemini API release notes: October 6, 2026
閱讀原文
| 評分 | 88 / 85(平均 86,門檻 60) |
|---|---|
| 狀態 | 精選 |
相關報導
Google 10 月 9 日起將 Gemini 免費使用者限制為 Flash Lite
從 10 月 9 日起,Google Gemini 免費方案使用者只能使用 Flash Lite 模型,此前免費使用者可在 Flash Lite、Flash 和 Pro 之間選擇。標準 Flash 模型改為需要每月 4.99 美元的 Google AI Plus 訂閱,而該訂閱也將不再包含 Gemini Pro,Google 表示會發郵件通知 AI Plus 使用者何時失去存取權限。
@GoogleDeepMind: At 740M parameters, it’s competitive across benchmarks – even outperforming some specialist models …
Google DeepMind 推出 EmbeddingGemma 2 嵌入模型,740M 引數在多項基準上具備競爭力,甚至超過部分引數量兩倍以上的專用模型。模型以 Apache 2.0 許可發布,權重已上線 Hugging Face 與 Kaggle。開發者可用它為應用加入多模態檢索,例如用語音備忘錄定位影片片段,也可與 Gemma 4 搭配實現端側私有 RAG。
Gemini 4 Argon 發布:輸出上限 1M token,限網路安全預覽
Google DeepMind 發布 Gemini 4 Argon,主打程式設計、企業知識工作與網路防禦,在 19 項基準中 13 項達到 SOTA,並首次實現最高 1M token 輸出(Long Decode Continuation 跨呼叫續寫)。目前僅面向政府使用者與 Fairwind 計劃中的可信網路安全人員開放,開發者、企業與消費者訪問時間未定。標準定價為每百萬輸入/輸出 token 4/20 美元,五折優惠後 2/10 美元,快取輸入再降 95%。
llama.cpp 新增 nimble 決策模型支援
llama.cpp 發布 b11364 版本,新增對 nimble 決策模型的支援(PR #29844)。該版本覆蓋 macOS、iOS、Linux、Android、Windows 與 openEuler 平台,提供 CPU、CUDA 12/13、Vulkan、ROCm 10.0、OpenVINO、SYCL、Snapdragon 的 Adreno GPU 與 Hexagon NPU 等後端建置;
ChatGPT 推出視覺廣告格式,先在影像生成中測試
OpenAI 宣布在 ChatGPT 推出新的視覺廣告格式,並擴充套件廣告測量工具與合作伙伴。該格式初期在影像生成過程中測試,廣告會明確標註且與生成的圖片分開,不影響 ChatGPT 給出的回答,本月晚些時候在美國面向首批廣告主開始。ChatGPT 每週觸達 12 億人。OpenAI 同時接入 Hightouch、Tealium、LiveRamp 的轉化資料整合,與 AppsFlyer、Adjust 等歸因夥伴合作,並與 DoubleVerify、IAS 試點品牌適配性評估。