AISpot

版本更新

近期事件

  1. 1
    熱度 1.02 個來源 · 2 則10/3 12:28
  2. 2
    熱度 0.82 個來源 · 2 則10/3 07:27
  3. 3
    熱度 0.83 個來源 · 4 則10/3 01:56
  4. 4
    熱度 0.72 個來源 · 2 則10/3 00:57
  5. 5
    熱度 0.61 個來源 · 2 則10/3 22:35

10月4日星期日 · 2 則

  1. llama.cpp releases● 精選AI 評分63

    llama.cpp 為 WebGPU 後端加入 f16 支援

    llama.cpp 在 WebGPU 後端為 fill/set_rows 操作加入 f16 支援(PR #29897),併發布 b11382 版本。該版本覆蓋 macOS Apple Silicon、iOS、Linux、Android、Windows 等平台,其中 macOS Apple Silicon 的 KleidiAI 建置被停用。對使用 WebGPU 推理的使用者,f16 支援可減少視訊記憶體佔用並提升相容性。

  2. Claude Code releasesAI 評分56

    v2.1.289

    Claude Code 更新至 v2.1.289,集中修復外掛系統、沙箱權限規則與終端渲染的多個缺陷。其中 Bash 拒絕或詢問規則此前在環境變數字首、裸變數賦值及沙箱自動放行場景下會被跳過,Read 拒絕規則也未覆蓋通過符號連結在 IDE 中 @ 提及或選中的檔案。此外還修復了外掛熱過載、本地資料夾市場外掛顯示陳舊副本、升級後首個會話不載入已安裝 mod,以及 VSCode 中 claude auth status 導致登出更頻繁的回退問題。

10月3日星期六 · 19 則

  1. llama.cpp releasesAI 評分32

    llama.cpp 修復 Windows 下 mtmd 棄用警告

    llama.cpp 發布 b11381 版本,修復了 mtmd 在 Windows 上觸發的 strdup 棄用警告(#29863),由 Hugging Face 的 Adrien Gallouët 提交。該版本繼續提供 macOS Apple Silicon(arm64)、Linux、Windows、Android 等多平台預編譯包,其中 macOS Apple Silicon 的 KleidiAI 加速版被標記為 DISABLED。

  2. llama.cpp releasesAI 評分44

    llama.cpp 新增 common_is_tty() 並修復 Windows 棄用警告

    llama.cpp 合併 PR #29860,新增 common_is_tty() 輔助函式並修復 Windows 上的棄用警告,作者為 Hugging Face 的 Adrien Gallouët。該提交同時更新了各平台預編譯產物,macOS Apple Silicon(arm64)正常提供,但啟用 KleidiAI 的 arm64 版本被標記為 DISABLED,openEuler 也處於 DISABLED 狀態。

  3. llama.cpp releases● 精選AI 評分78

    llama.cpp 修復 Ling 3.0 解析器對 json_schema 的支援

    llama.cpp 合併 PR #29813,讓 Ling 3.0 解析器支援 inputs.json_schema,此前 response_format 請求不受約束。新邏輯為回應格式語法路徑優先於工具呼叫,啟用思考時要求 JSON 前有 think 塊,且 JSON 後不允許尾隨文字。該修復對應 issue #29652,由 Claude Opus 5.5 輔助完成。

  4. llama.cpp releasesAI 評分42

    llama.cpp 的 OpenVINO 後端更新,MoE 推理大幅提速

    ggml-openvino 後端更新至 2026.4.1,新增 MoE 路由融合與 GDN 歸一化融合,並預設在 GPU 上啟用 MoE 融合。在 Arc B390 上跑 gemma-4-26B-A4B,配合 q4_asym64 重新量化,pp512 從 66.16 t/s 提升到 1608.73 t/s,困惑度基本不變。同時修復了 stateful 執行下 rank-3 軸處理導致的 MoE 崩潰,並改進裝置列舉與記憶體上報。

  5. llama.cpp releases● 精選AI 評分72

    llama.cpp 最佳化 lightning indexer 視訊記憶體與多後端支援

    llama.cpp 合併了 qwen4exp 的 lightning indexer 最佳化,把索引器打分視訊記憶體減半:原先同時存在兩個 [n_pool, n_idx_h, n_tokens] f32 張量,現在每個 head 單獨計算並原地累加進一個 [n_pool, n_tokens] 分數。同時 CUDA 支援 4 heads、Metal 用函式常量傳 head 數、Vulkan 按 keys×tokens 分塊並向量化 fp16 點積。

  6. Hacker News front pageAI 評分45

    GitHub 新儀表盤成為預設檢視,可檢視 agent 會話

    GitHub 新儀表盤體驗已從功能預覽轉為所有使用者的預設檢視。它把活躍 agent 會話、issue 和 pull request 集中在一處,每類列表最多顯示 12 項並支援篩選;更新動態移到獨立的 Feed 標籤頁。你還能直接在儀表盤上把 issue 指派給 Copilot coding agent,或在 Copilot Chat 中開啟 pull request。想用回舊版,點選 Preview 旁的下拉選單即可隨時切換。

  7. llama.cpp releases● 精選AI 評分80

    llama.cpp 為投機解碼加入機率取樣與拒絕取樣

    llama.cpp 合併 PR #27694,把 simple draft 與 MTP 的投機解碼改為機率取樣,目標模型用拒絕取樣驗證草稿 token。新增開關控制機率草稿取樣,預設仍為貪心;語法約束請求回退到 argmax,並支援在拒絕取樣中處理語法約束。同時修復了草稿取樣器與目標模型共用 rng 流、掩碼後分布未重歸一化等問題,並隨草稿一起截斷候選。

  8. llama.cpp releasesAI 評分58

    llama.cpp 修復 qkx3 量化縮放搜尋的非法舍入

    llama.cpp 合併 PR #29817,在 qkx3 量化級別送入 nearest_int 前先鉗制到 [0, nmax],避免 imatrix 縮放搜尋產生無窮、NaN 或越界值時觸發 Debug 建置斷言。該問題由 #29804 報告,修復同時為 q2_K、q4_K、q5_K、q4_1、q5_1 的退化 imatrix 分組補充迴歸測試。合法範圍內的取值行為不變,macOS Apple Silicon(arm64)等預編譯包已隨本次發布更新。

  9. llama.cpp releases● 精選AI 評分68

    llama.cpp 新增 /v1/systemone API,支援 laya 等 5 個模型

    llama.cpp 發布 b11361,在 server 中新增 /v1/systemone API,支援 laya、julia-1、lev、openjev、kev 五個模型,並附帶模型轉換指令碼。該版本加入了共享 prompt 字首與視覺輸入支援,新增用於測試的小模型 openjev tiny,文件中明確說明不支援 date_facts。macOS Apple Silicon(arm64)建置正常,但啟用 KleidiAI 的 arm64 版本被標記為 DISABLED;

10月2日星期五 · 8 則

  1. Claude Code releases● 精選AI 評分84

    Claude Code 2.1.288 修復恢復會話丟失上下文與超時中斷問題

    Claude Code 發布 v2.1.288。修復了長對話報「Prompt is too long」卻不自動壓縮、--resume 丟失剛被壓縮恢復的檔案與上下文、恢復的會話不儲存該輪最後回覆,以及回應中途 API 超時導致整輪失敗——非互動會話與子代理現在會從部分回應繼續,僅有思考內容的回應會重試。

  2. llama.cpp releasesAI 評分50

    llama.cpp 為 ggml 緩衝區介面新增 alloc_buffer_n 與 get_alloc_size_n

    llama.cpp 的 ggml 後端緩衝區型別介面新增 alloc_buffer_n 與 get_alloc_size_n 方法,並公開 ggml_backend_buft_alloc_buffer_n、ggml_backend_buft_get_alloc_size_n 兩個 API。預設實現負責多緩衝區分割與張量分配,Meta buffer type 提供自訂實現,按裝置建立子上下文並委託給 simple buffer type;

10月1日星期四 · 1 則

  1. Claude Code releases● 精選AI 評分78

    Claude Code v2.1.287 新增 Claude Mods 與 You should know 外掛

    Claude Code 發布 v2.1.287:新增 Claude Mods,外掛可以修改更深層行為;並內建 You should know,由側邊 agent 監視你或 Claude 可能遺漏的內容,用 /plugin enable cc-plugin-you-should-know@builtin 開啟(需第一方會話且開啟遙測)。agents 檢視新增 n:<text> 過濾器匹配會話名與任務;

9月30日星期三 · 3 則

  1. OpenCode releases● 精選AI 評分75

    OpenCode v1.18.34 修復 macOS 27+ 本地編譯執行問題

    OpenCode 發布 v1.18.34,修復本地編譯的 macOS 二進位制在 macOS 27+ 上無法可靠執行的問題,改為編譯後重新簽名,並用 Developer ID 簽名 macOS CLI 發布版。同時模型請求現在會傳送帶名稱空間的會話與父會話身份頭,TUI 的 /status 對話方塊改用 path.sep 提取外掛名,網頁文件修正了 GPT 6.1 Sol 的快取定價。

  2. Ollama releases● 精選AI 評分76

    Ollama v0.35.0 加入決策模型,返回選擇與機率而非文字

    Ollama v0.35.0 新增決策模型支援,通過 /v1/systemone 端點呼叫,基於 TypeSafe 的 Jev API。這類模型不返回文字,而是返回選擇、機率和分數,適合工單分流、模型路由和內容分類;目前可用 Bespoke Labs 的 Nimble 和 Together AI 的 Tev1,用 ollama pull nimble 拉取。

9月29日星期二 · 4 則

  1. Claude Code releases● 精選AI 評分70

    Claude Code v2.1.285:可關閉 WebFetch,新增 API 提供商限制

    Claude Code 發布 v2.1.285,新增環境變數 CLAUDE_CODE_DISABLE_WEB_FETCH 用於關閉 WebFetch 工具,並加入 allowedProviders 託管設定,限制一臺機器可用的 API 提供商(Anthropic API、自訂 endpoint、Bedrock、Mantle、Vertex AI、Foundry、AWS 上的 Claude Platform、Cloud gateway)。

  2. MLX releases● 精選AI 評分70

    v0.32.3

    MLX 發布 v0.32.3,一批修復覆蓋 Metal、CUDA 與 CPU 後端,並新增面向 M5 的非量化 matmul 調優。Metal 側加入 gated delta nets 核心與 fast.cross_entropy 融合核心,降低 SDPA D256/D512 記憶體佔用,同時修復 fp 量化 matmul 在量化維度非 32 倍數時的結果損壞、GGUF 張量維度校驗與零尺寸軸的 scan/sort。

  3. releasebot: ChatGPTAI 評分61

    ChatGPT Sites 支援桌面瀏覽器編輯和定時發布

    ChatGPT 的 Sites 現支援在桌面瀏覽器中繼續編輯已發布的站點:Plus 和 Pro 的站點所有者與編輯者可從已發布的 Site 選擇 Edit site,回到 ChatGPT 編輯、審閱改動並自行決定何時發布。站點所有者還可在 Automations 中建立週期性雲端計劃,按計劃更新站點。編輯入口明確為桌面瀏覽器,且這些更新僅在 Sites 支援的範圍提供,更多建立與管理細節見官方文件。

9月28日星期一 · 2 則

  1. OpenCode releases● 精選AI 評分63

    OpenCode v1.18.33 修復 Cloudflare 超時與 Gemini 思考引數

    OpenCode 發布 v1.18.33:Cloudflare AI Gateway 上的模型現在會遵循 provider 的回應與流超時,Gemini 的 thinking 預設值與 effort 選項也與各代模型支援的控制對齊。同版本還讓 MCP 瀏覽器啟動失敗在啟動器立即退出時被報告,並讓除錯配置輸出遮蔽憑據與敏感 header。

9月25日星期五 · 1 則

  1. Ollama releases● 精選AI 評分86

    Ollama v0.40.0:Apple Silicon 上預設改用 MLX 執行模型

    Ollama 發布 v0.40.0,在 Apple Silicon 裝置上,MLX 執行時支援的模型架構會自動改用 MLX 執行,無需手動切換。用法與以往一致,例如 ollama pull qwen3.8 後 ollama run qwen3.8。該版本目前為預發布版(v0.40.0-rc0,變更範圍 v0.34.4 到 v0.40.0-rc0),官方稱預發布期間會測試並啟用更多模型,尚未說明具體支援清單與效能差異。

更早的內容