搜尋
找到 13 筆
MLX LM releases● 精選4/22 08:43AI 評分65
MLX 在 2026-04-22 發布補丁版 v0.31.3,以大量 bug 修復為主,並新增執行緒本地生成流(thread local generation stream),配合 MLX v0.31.2。修復覆蓋 BatchKVCache、BatchRotatingKVCache 與 ArraysCache 的 batch 維度不匹配,以及服務端並行工具呼叫、MiniMax M2 並行工具呼叫和 Mistral 空 tool_call_end 導致的工具呼叫中斷。
r/ClaudeAI top of the day10/2 20:09AI 評分50
免費開源的 Claude Code 桌面版外掛 Claude Fables 已發布在 GitHub,Claude 工作時它會觀察每次工具呼叫和每行輸出,每隔幾秒在輸入框上方用一段短動畫複述最新進展。Claude 是個橙色小生物,有 20 種動作、7 個場景和 11 種視覺風格,用 /fables style 切換;安裝只需把倉庫路徑寫進 ~/.claude/settings.json 的 CLAUDE_CODE_PLUGIN_DIRS 再重啟應用。
Gemini API release notes9/17 01:00AI 評分50
Gemini API 於 9 月 17 日發布 antigravity-preview-09-2026,取代並棄用 antigravity-preview-05-2026,舊版將在 2026 年 10 月 5 日關停。若在遠端沙箱(environment: "remote")且只讀 output_text 或 model_output 步驟,只需更新 agent 字串,其他不變。
MLX LM releases● 精選2/4 21:27AI 評分79
MLX LM 發布 v0.30.6,新增 Kimi-K2.5、LongCat Flash/Lite 和 Step 3.5 Flash 等模型支援,並引入 Transformers v5。服務端加入分散式推理,支援 chat_template_kwargs、top_logprobs 與載入自定義模型,同時新增 CLI。
LM Studio blog● 精選8/10 01:00AI 評分89
Meta 發布 30B 開源模型 Muse Glimmer,Apache 2.0 許可,即日起可在 LM Studio Bionic 本地執行,Mac 與 PC 均可。它支援多步 agent 任務、工具呼叫與影像輸入,在 LM Studio 內部評測 BionicBench v0.1 的 18 項任務中完成率 83.3%,高於 Gemma 4 31B 和 Qwen 3.6 27B 的 77.7%。
OpenAI News10/2 17:15AI 評分48
OpenAI 發布了一份面向初創公司的 GPT-6 系列模型指南,教團隊如何選擇 GPT-6 模型、調整推理強度、改進提示詞與技能、協調工具,併為生產環境準備 workflows。指南覆蓋從選型到上線的完整流程,目標讀者是用 GPT-6 構建產品的初創團隊。
Latent Space● 精選9/30 23:23AI 評分81
OpenAI 在 DevDay 上發布 GPT-6.1 Sol、個人助理產品 Dots,以及內建 Computer Use 的 Agents API,開發者可基於與 Codex、ChatGPT 相同的 Computer Use 構建應用。Ari Weinstein 稱 GPT-6.1 Sol 成本是 Astra 的五分之一,用在 Computer Use 上只需七分之一。
OpenRouter announcements● 精選9/8 01:00AI 評分67
OpenRouter 發布 beta 版 openrouter:shell 服務端工具與 Files API,任何支援工具呼叫的模型都能在託管 Linux 容器裡執行命令並讀寫檔案。它相容 OpenAI 的 shell 工具(Responses API)和 Anthropic 的 bash 工具(Messages API),其中 bash 預設由你的應用本地執行,把 engine 設為 openrouter 才會在服務端沙箱執行。
Kimi blog● 精選10/2 22:11AI 評分83
Kimi K2.6 已開源,可通過 Kimi.ai、Kimi App、API 和 Kimi Code 使用,主打長程編碼、長時間執行與 agent swarm。官方稱其在內部 Kimi Code Bench 上較 K2.5 顯著提升:一個案例是在 Mac 上用 Zig 實現並最佳化推理,4000+ 次工具呼叫、連續執行 12 小時、14 輪迭代後吞吐從約 15 升至約 193 tokens/sec,比 LM Studio 快約 20%;
Kimi blog● 精選10/2 22:11AI 評分65
Kimi 發布 Agent Swarm,Kimi K2.5 最多可並行部署 100 個子代理、執行 1500 次以上工具呼叫,出結果比序列執行快 4.5 倍。它不只是多代理協作,而是讓模型自行組建有分工的組織:自己決定何時並行、招誰、如何委派,適合大規模檢索、批次下載、多檔案處理與多視角分析。
NVIDIA blog● 精選10/2 00:44AI 評分86
GPT-6 Astra Ultrafast 已上線,執行在 NVIDIA Blackwell GPU 上,面向 OpenAI 內部以及符合條件的 ChatGPT Work 和 Codex 使用者開放,token 生成速度最高可達 Astra Standard 模式的 8 倍。開發者今天就能通過 API 呼叫,接入方式、定價與實現細節見官方 Ultrafast 指南。更快的生成可縮短 coding agent 的編輯—測試—除錯迴圈,減少工具呼叫之間的等待時間。
MLX LM releases● 精選4/7 23:15AI 評分75
MLX 生態的 mlx_lm 發布 v0.31.2(上一版為 v0.31.0),重點是新增 Gemma 4 支援,包括工具呼叫解析器、多 token 的 think 與工具起止標記,並修復其量化逐層投影載入。此次還重構了 BatchGenerator、為非裁剪型快取快取系統提示與使用者訊息,批處理生成器恢復 max-kv-size 引數,伺服器新增 --allowed-origins 選項,並加入 Nemotron super 支援。
Google DeepMind blog9/24 17:20AI 評分50
Google 於 9 月 24 日發布 Gemini 3.8 Live with Live Avatar,把近即時影片生成與語音結合,為企業的對話 AI 加上唇形同步、表情與流暢輪替的視覺形象,即日起在 Gemini Enterprise 提供。它支援非同步工具呼叫,可在對話不中斷的情況下後臺取數;原生語音到語音同步可跨 97 種語言切換,且不降低影片質量、不產生畫面漂移。