AISpot

搜尋

找到 5 筆

Gemini API release notes9/3 01:00AI 評分35

Google 將音樂生成模型 Lyria 3.5 正式開放

Google 於 2026 年 9 月 3 日把下一代音樂生成模型 lyria-3.5 轉為正式可用(GA)。它支援文字與影像輸入,可生成整首歌曲,音樂連貫性與人聲自然度提升,並支援對時長和結構的細粒度控制,輸出 44.1 kHz 立體聲。開發者可在 Gemini API 的 Music generation 指南中檢視詳情與程式碼示例。

Hugging Face blog● 精選10/2 16:19AI 評分65

Ai2 開源 AstaBrief 8B 科學報告生成模型

Ai2 開源了 8B 的科學報告生成模型 AstaBrief,可把研究問題和檢索到的文獻片段直接寫成帶引用的報告。它已在 Asta 的 Generate a report 功能中以 Fast mode 上線,與 Claude 驅動的 Thinking mode 並列:Fast mode 平均 51.1 秒生成一份報告,Thinking mode 為 178.5 秒,快約 3.5 倍。模型基於 Qwen3-8B,用 SFT 加 DPO 訓練,一次成稿,跳過了片段摘要與聚類環節。

Apple Machine Learning Research10/2 01:00AI 評分53

論文證明離散擴散單步取樣僅能匹配條件獨立位置

研究證明,離散擴散(含 remasking 與 uniform-state 取樣器)的某一步只有在所寫入位置在已固定 token 條件下相互獨立時,才與訓練分佈一致;任何 per-position 分佈的乘積都無法匹配存在依賴的一組 token。文中指出畫素、音素、詞等常見領域的 token 之間存在固有依賴,而這類取樣器每步會寫入多個 token 位置,每個位置從各自的 per-position 分佈取樣,並依據同一批分佈決定寫入哪些位置。