AISpot

搜尋

找到 6 筆

Google DeepMind blog9/24 17:20AI 評分50

Gemini 3.8 Live 加入 Live Avatar 即時影片對話形象

Google 於 9 月 24 日發布 Gemini 3.8 Live with Live Avatar,把近即時影片生成與語音結合,為企業的對話 AI 加上唇形同步、表情與流暢輪替的視覺形象,即日起在 Gemini Enterprise 提供。它支援非同步工具呼叫,可在對話不中斷的情況下後臺取數;原生語音到語音同步可跨 97 種語言切換,且不降低影片質量、不產生畫面漂移。

Gemini API release notes9/18 01:00AI 評分56

Gemini API 限制 2.5 模型訪問,新專案改用 3.5 Flash-Lite 或 3.8 Flash

Gemini API 在 2026 年 9 月 18 日的更新中把 Gemini 2.5 系列模型的存取權限限制為過去曾實際使用過它們的使用者。2.5 並未被棄用,仍會繼續通過 API 提供服務,直至另行通知。新專案官方建議改用最新的 3.5 Flash-Lite 或 3.8 Flash,官方稱這是為了給舊工作流和新應用都保留足夠容量。

Gemini API release notes● 精選9/15 01:00AI 評分61

Gemini API 兩款即時語音模型正式可用

Gemini API 於 2026 年 9 月 15 日讓兩款音訊到音訊模型正式可用(GA):gemini-3.8-live 與 gemini-3.8-live-extended-thinking,均通過 Live API 服務即時語音應用。前者是低延遲語音代理與即時對話的預設選擇,無推理延遲,支援交錯推理、預設非同步函式呼叫和完整會話客戶端內容更新。後者是高推理模型,可在即時音訊互動中做後臺推理,適合需要更強後臺推理的場景。

Google AI blog● 精選10/2 16:00AI 評分68

Google 發布 Gemini 4 Argon,100 萬 token 輸出上限

Google 9 月發布新前沿模型 Gemini 4 Argon,擁有業界領先的 100 萬 token 輸出上限,面向編碼、網路安全防禦、金融研究與法律起草等重負載任務;目前僅通過 Fairwind Program 向受信任的網路安全防禦者開放,尚未放開給開發者、企業和消費者。