Google DeepMind blog9/23 16:25AI 評分56
Gemini 3.8 Flash TTS 發布,音色庫擴至 2000+
Google 推出 Gemini 3.8 Flash TTS 與 Flash-Lite TTS 兩款語音模型。音色庫從 30 個擴到 2000+,用 30 秒樣本即可復刻音色,支援 100 多種語言,並可逐行控制語氣與節奏。Flash TTS 在 Hume AI 語音設計基準得 71.4 分排第一。
找到 4 筆
Google 推出 Gemini 3.8 Flash TTS 與 Flash-Lite TTS 兩款語音模型。音色庫從 30 個擴到 2000+,用 30 秒樣本即可復刻音色,支援 100 多種語言,並可逐行控制語氣與節奏。Flash TTS 在 Hume AI 語音設計基準得 71.4 分排第一。
Gemini API 發布兩款 TTS 模型並上線 Voices 端點,支援語音設計、克隆與 150+ 預置音色。
Gemini API 把 2.5 系列模型限制為過去活躍使用過的使用者,模型未廢棄,仍會繼續通過 API 提供。新專案建議改用 3.5 Flash-Lite 或 3.8 Flash。
Google 發布前沿模型 Gemini 4 Argon,輸出上限 100 萬 token,主打複雜推理與網路安全防禦,目前通過 Fairwind 計劃向可信防禦者開放。同月還推出 Gemini 3.8 Flash 與 3.8 Flash Cyber,後者提供自主漏洞發現與自動打補丁能力。