Gemini API 上線 Lyria 3.5 音樂生成模型
Google 在 Gemini API 正式發布 lyria-3.5,支援文字與影像輸入,生成 44.1 kHz 立體聲全長歌曲。
找到 27 筆
Google 在 Gemini API 正式發布 lyria-3.5,支援文字與影像輸入,生成 44.1 kHz 立體聲全長歌曲。
Gemini API 發布 antigravity-preview-09-2026,取代 05-2026 版,內建工具引數改為 PascalCase,舊版將於 10 月 5 日停用。
Google Cloud API Gateway 現在原生充當遠端 MCP 伺服器,不再需要自建中介軟體。開發者在現有 OpenAPI 3.x 規範里加上 x-google-api-management.mcp 等註解,就能把 REST 操作變成 agent 可發現的工具。閘道器會自動把 MCP JSON-RPC 請求轉成 REST 呼叫,並沿用原有認證、配額與日誌策略。
Gemini API 把 2.5 系列模型限制為過去活躍使用過的使用者,模型未廢棄,仍會繼續通過 API 提供。新專案建議改用 3.5 Flash-Lite 或 3.8 Flash。
OpenRouter 推出 openrouter:shell 伺服器工具和 Files API,任何模型都能在託管 Linux 容器裡執行命令、讀寫檔案,目前為 beta。沙箱按每秒 0.0001 美元計費,計入請求費用並包含 Files API 用量。容器空閒 5 分鐘後休眠。
OpenRouter 推出 Batch API,支援 70 多個模型,批次請求按每 token 正常價格約 50%(有時更低)計費。請求會在提交後 24 小時視窗內完成,beta 兩週內完成 23 萬多個批次,中位數 7 分鐘,90% 在一小時內。支援 chat completions、responses、messages 與 embeddings。
Gemini API 發布兩款 TTS 模型並上線 Voices 端點,支援語音設計、克隆與 150+ 預置音色。
Albertsons 正使用 ChatGPT Enterprise 和 OpenAI API,幫助團隊更快工作,並讓數百萬顧客的購物更輕鬆。
OpenAI DevDay 發布 GPT-6.1 Sol,Computer Use 成本僅為 Astra 的七分之一。Agents API 首次內建 Computer Use,開發者可複用 Codex 與 ChatGPT 的同款能力。同場還推出非同步工具呼叫、WebSockets、UltraFast 推理與 Decisions API,後者目前是 Luna 的封裝。
OpenRouter 上線 Security Center,可在 Settings > Security 一處檢視所有工作區金鑰,並按風險批次停用、歸檔或加消費上限,單次最多 500 個。該功能所有套餐型別可用;IP allowlist 僅 Enterprise 組織管理員可用。官方自查 85 名員工有 1000 多個活躍金鑰,其中 168 個數月未用。
Claude API 的快取診斷結束 beta,不再需要 cache-diagnosis-2026-04-07 請求頭。在 Messages 請求裡帶上 diagnostics 物件即可啟用,仍傳送舊請求頭的請求照常工作。POST /v1/messages 的回應現在始終包含 diagnostics 欄位,未啟用時為 null。
Anthropic 上線 Claude Sonnet 5.5,已在 Claude API、Amazon Bedrock、Google Cloud、Microsoft Foundry 等平台可用。
Claude Code 發布 v2.1.288:回應中途 API 超時不再讓整輪失敗,非互動會話與 subagent 會從部分回應繼續,純 thinking 回應會重試。還修了長對話誤報 Prompt is too long、--resume 丟上下文、會話末條回覆未儲存等問題。/code-review 新增 --max-findings 調整報告條數。
Anthropic 宣布棄用 Claude Sonnet 4.5(claude-sonnet-4-5-20250929),Claude API 上的退役日期為 2026 年 11 月 30 日,官方建議遷移到 Claude Sonnet 5.5。詳情見 Model deprecations 文件。
GPT-6 Astra Ultrafast 已在 OpenAI API 上線,並向符合條件的 ChatGPT Work 與 Codex 使用者開放。它執行在 NVIDIA Blackwell GPU 上,token 生成速度最高是 Astra Standard 模式的 8 倍,可縮短 coding agent 的 edit-test-debug 迴圈。
Meta Superintelligence Labs 推出 Muse Spark 1.1 多模態推理模型,面向 agentic 任務,在工具呼叫、computer use 與編碼上大幅提升,並支援 100 萬 token 上下文管理。新 Meta Model API 開啟公開預覽,模型已在 Meta AI 應用與 meta.ai 以 Thinking 模式上線。
Claude Code v2.1.284 新增 Claude Sonnet 5.5(claude-sonnet-5-5),已是 Anthropic API 的預設 Sonnet 模型:1M 上下文,$2/$10 每百萬 token,快取讀取 $0.20/Mtok。
Anthropic 發布 Claude Code v2.1.285,新增 CLAUDE_CODE_DISABLE_WEB_FETCH 環境變數可關閉 WebFetch 工具,claude --desktop 可直接在當前目錄開啟桌面應用,並新增 allowedProviders 設定限制機器可用的 API 供應商。
輸出前被拒答的請求重新計費,僅限 bio、frontier_llm、reasoning_extraction 三類;中途中止的拒答此前已在計費。費用按實際執行的模型費率收取,其他類別的輸出前拒答仍不計費,回退額度不變。該變更在所有平台生效。
OpenRouter 推出 Model Router Benchmarks 頁面,用多領域基準給各家模型路由器打質量、速度、成本分。頁面用 Router Index 把三項合成 0 到 10 分,預設權重質量 60%、單任務耗時 20%、成本 20%,可拖滑塊調整。列出的路由器都能在 OpenRouter 上直接替換模型試用。
Ollama v0.35.0 支援決策模型,經 /v1/systemone 呼叫,返回選擇、機率和分數而非文字。首批可用模型為 Bespoke Labs 的 Nimble 和 Together AI 的 Tev1。支援 choice、noul、score 三種問題型別,適用於工單分類、模型路由和內容分類。
Anthropic 推出 Claude Opus 5.5,預設 1M token 上下文、128k 最大輸出,每 MTok 價格從 $5/$25 降到 $4/$20。該模型思考無法關閉,只能靠 effort 引數控制深度,tool_choice 的 any 與 tool 會返回 400。另有 beta:可在對話中途的 system 訊息裡定義工具。
Google DeepMind 發布 Gemini 4 Argon,但僅限政府使用者與 Fairwind 計劃網路安全人員預覽。它通過 Long Decode Continuation 把輸出上限做到行業首個 1M token,此前為 64K。定價 $4/$20 每百萬 token,五折後 $2/$10,快取輸入再降 95%。
博主 basnijholt 發文論證自託管 AI 不能省錢,但他依然堅持自託管。他明確表示不會把 200 GB 郵件、訊息和位置歷史交給 API,無論是否零資料保留。他還指出,拿 200 美元訂閱與 Qwen 3.8 27B 相比並不對等。
OpenRouter 上線 US In-Region Routing,配合去年 10 月的 EU 路由,把請求改發 us.openrouter.ai 或 eu.openrouter.ai 即可在美國或歐盟境內解密與推理。區域內無可用供應商時請求直接 404,不會外洩。該功能僅在 Business 與 Enterprise 方案提供。
Kimi K3 發布,是首個開源 3T 級模型:2.8T 引數、原生視覺、100 萬 token 上下文,已在 Kimi.ai、Kimi Work、Kimi Code 與 Kimi API 上線,預設最高思考強度。官方稱其整體效能仍落後 Claude Fable 5 與 GPT 5.6 Sol,但在評測集上達到前沿水平。完整權重將於 2026 年 7 月 27 日放出。
Anthropic 推出生命科學驗證計劃(LSVP),讓通過資質稽核的生命科學團隊在 Mythos 5.1、Opus 5、Sonnet 5 上使用更寬鬆的生物學安全限制,已通過早期訪問接入數十家機構,現開放申請。計劃分 Standard Use(團隊級,一年續期)與 High-risk Use(單專案,六個月續期)兩類授權,可用於 Claude Code、API 等所有產品介面。執行方式由即時攔截改為離線監測。