AISpot

Gemini Nano Banana 2.1 影像模型正式可用

Gemini API release notes10/6 01:00官方公告模型開發工具

Google 將 Gemini Nano Banana 2.1(gemini-nano-banana-2.1)轉為正式可用(GA),這是繼 Nano Banana 2(gemini-3.1-flash-image)之後的影像生成與對話式編輯模型。它在保持 Flash 級速度與成本的同時,提升了視覺品質、提示詞遵循、多輪角色一致性、文字渲染,並支援 1:4、4:1、1:8、8:1 的寬幅與全景比例,輸出覆蓋 1K、2K、4K 解析度。

官方確認 Nano Banana 2.1 轉 GA,並給出舊影像模型 10 月 29 日的關停日期,使用 Gemini 影像 API 的開發者需要據此安排遷移與比例、解析度適配。

原標題:Gemini API release notes: October 6, 2026
閱讀原文

評分88 / 85(平均 86,門檻 60)
狀態精選

相關報導

The Verge AI● 精選10/6 14:19AI 評分90

Google 10 月 9 日起將 Gemini 免費使用者限制為 Flash Lite

從 10 月 9 日起,Google Gemini 免費方案使用者只能使用 Flash Lite 模型,此前免費使用者可在 Flash Lite、Flash 和 Pro 之間選擇。標準 Flash 模型改為需要每月 4.99 美元的 Google AI Plus 訂閱,而該訂閱也將不再包含 Gemini Pro,Google 表示會發郵件通知 AI Plus 使用者何時失去存取權限。

X @GoogleDeepMind● 精選10/6 17:04AI 評分80

@GoogleDeepMind: At 740M parameters, it’s competitive across benchmarks – even outperforming some specialist models …

Google DeepMind 推出 EmbeddingGemma 2 嵌入模型,740M 引數在多項基準上具備競爭力,甚至超過部分引數量兩倍以上的專用模型。模型以 Apache 2.0 許可發布,權重已上線 Hugging Face 與 Kaggle。開發者可用它為應用加入多模態檢索,例如用語音備忘錄定位影片片段,也可與 Gemma 4 搭配實現端側私有 RAG。

Latent Space● 精選10/1 07:45AI 評分92

Gemini 4 Argon 發布:輸出上限 1M token,限網路安全預覽

Google DeepMind 發布 Gemini 4 Argon,主打程式設計、企業知識工作與網路防禦,在 19 項基準中 13 項達到 SOTA,並首次實現最高 1M token 輸出(Long Decode Continuation 跨呼叫續寫)。目前僅面向政府使用者與 Fairwind 計劃中的可信網路安全人員開放,開發者、企業與消費者訪問時間未定。標準定價為每百萬輸入/輸出 token 4/20 美元,五折優惠後 2/10 美元,快取輸入再降 95%。

OpenAI News● 精選10/5 11:00AI 評分85

ChatGPT 推出視覺廣告格式,先在影像生成中測試

OpenAI 宣布在 ChatGPT 推出新的視覺廣告格式,並擴充套件廣告測量工具與合作伙伴。該格式初期在影像生成過程中測試,廣告會明確標註且與生成的圖片分開,不影響 ChatGPT 給出的回答,本月晚些時候在美國面向首批廣告主開始。ChatGPT 每週觸達 12 億人。OpenAI 同時接入 Hightouch、Tealium、LiveRamp 的轉化資料整合,與 AppsFlyer、Adjust 等歸因夥伴合作,並與 DoubleVerify、IAS 試點品牌適配性評估。