Google 推出 Gemini 3.8 Flash TTS 與 Flash-Lite TTS
Google 推出 Gemini 3.8 Flash TTS 與 Gemini 3.8 Flash-Lite TTS 兩款文字轉語音模型,是 Gemini 迄今最有表現力的音訊生成模型,已在 Google AI Studio、Gemini API、Gemini Enterprise、Gemini Notebook 和 Google Vids 上線。
找到 6 筆
Google 推出 Gemini 3.8 Flash TTS 與 Gemini 3.8 Flash-Lite TTS 兩款文字轉語音模型,是 Gemini 迄今最有表現力的音訊生成模型,已在 Google AI Studio、Gemini API、Gemini Enterprise、Gemini Notebook 和 Google Vids 上線。
Google 在 2026 年 9 月 22 日的 Gemini API 更新中,將 Gemini 3.8 Flash TTS 與 Gemini 3.8 Flash-Lite TTS 兩款文字轉語音模型正式 GA,並新增 /v1beta/voices 端點。旗艦款 gemini-3.8-flash-tts 主打錄音棚級音質、細膩表演、地區口音與長時多輪穩定;
Google 於 9 月 24 日發布 Gemini 3.8 Live with Live Avatar,把近即時影片生成與語音結合,為企業的對話 AI 加上唇形同步、表情與流暢輪替的視覺形象,即日起在 Gemini Enterprise 提供。它支援非同步工具呼叫,可在對話不中斷的情況下後臺取數;原生語音到語音同步可跨 97 種語言切換,且不降低影片質量、不產生畫面漂移。
Gemini API 在 2026 年 9 月 18 日的更新中把 Gemini 2.5 系列模型的存取權限限制為過去曾實際使用過它們的使用者。2.5 並未被棄用,仍會繼續通過 API 提供服務,直至另行通知。新專案官方建議改用最新的 3.5 Flash-Lite 或 3.8 Flash,官方稱這是為了給舊工作流和新應用都保留足夠容量。
Gemini API 於 2026 年 9 月 15 日讓兩款音訊到音訊模型正式可用(GA):gemini-3.8-live 與 gemini-3.8-live-extended-thinking,均通過 Live API 服務即時語音應用。前者是低延遲語音代理與即時對話的預設選擇,無推理延遲,支援交錯推理、預設非同步函式呼叫和完整會話客戶端內容更新。後者是高推理模型,可在即時音訊互動中做後臺推理,適合需要更強後臺推理的場景。
Google 9 月發布新前沿模型 Gemini 4 Argon,擁有業界領先的 100 萬 token 輸出上限,面向編碼、網路安全防禦、金融研究與法律起草等重負載任務;目前僅通過 Fairwind Program 向受信任的網路安全防禦者開放,尚未放開給開發者、企業和消費者。