搜尋
找到 14 筆
llama.cpp releases10/3 22:35AI 評分32
llama.cpp 發布 b11381 版本,修復了 mtmd 在 Windows 上觸發的 strdup 棄用警告(#29863),由 Hugging Face 的 Adrien Gallouët 提交。該版本繼續提供 macOS Apple Silicon(arm64)、Linux、Windows、Android 等多平台預編譯包,其中 macOS Apple Silicon 的 KleidiAI 加速版被標記為 DISABLED。
llama.cpp releases10/3 16:02AI 評分44
llama.cpp 合併 PR #29860,新增 common_is_tty() 輔助函式並修復 Windows 上的棄用警告,作者為 Hugging Face 的 Adrien Gallouët。該提交同時更新了各平台預編譯產物,macOS Apple Silicon(arm64)正常提供,但啟用 KleidiAI 的 arm64 版本被標記為 DISABLED,openEuler 也處於 DISABLED 狀態。
X @deepseek_ai● 精選10/2 08:00AI 評分75
DeepSeek 推出 DeepSeek Harness 的打包桌面版,覆蓋 macOS 與 Windows,Linux 使用者可通過 npm 上的 @deepseek-ai/dsh 包獲取。官方在社交平台公布了這一訊息,並給出下載地址 deepseek.com/harness。
llama.cpp releases● 精選10/3 09:36AI 評分72
llama.cpp 合併 PR #29831,為 clef 決策模型加入純文字推理支援,並更新 gguf-py 常量。該版本覆蓋 macOS Apple Silicon、Linux、Windows、Android 等平台,其中 Apple Silicon 的 KleidiAI 加速建置被停用。
llama.cpp releases10/3 22:09AI 評分44
llama.cpp 發布 b11380 版本,將依賴庫 cpp-httplib 升級到 0.59.0。該版本繼續為 macOS Apple Silicon(arm64)、Linux、Windows、Android 等平台提供預編譯建置,其中 macOS Apple Silicon 的 KleidiAI 加速版本被標記為 DISABLED。
llama.cpp releases● 精選10/2 23:23AI 評分65
llama.cpp 發布 b11352 版本,主要改動是最佳化 qwen4exp 的掩碼(mask)建置(#29824),並將同一改動應用到 GLM5-next。該版本繼續提供 macOS Apple Silicon(arm64)、iOS、Linux、Windows、Android 等平台建置,涵蓋 CUDA 12/13、Vulkan、ROCm 10.0、OpenVINO、SYCL 與 Snapdragon 後端。
llama.cpp releases10/2 16:43AI 評分40
llama.cpp 發布 b11349,新增 Vulkan 管線編譯問題的日誌輸出(#29794)。該版本提供 macOS/iOS、Linux、Android、Windows、openEuler 建置產物,涵蓋 Ubuntu x64/arm64/s390x CPU、Vulkan、CUDA 12.8/13.4、ROCm 10.0、OpenVINO、SYCL FP32/FP16,以及 Snapdragon 的 CPU、Adreno GPU、Hexagon NPU。
llama.cpp releases10/3 02:06AI 評分58
llama.cpp 合併 PR #29844,新增對 nimble 決策模型的支援。該版本覆蓋 macOS Apple Silicon(arm64)、Ubuntu、Windows、Android 等多平台建置,其中 macOS Apple Silicon 的 KleidiAI 加速版本被標記為 DISABLED。官方發布頁為 llama.app,建置證明見 GitHub attestations。
llama.cpp releases10/2 14:52AI 評分48
llama.cpp 發布建置 b11346,本次改動是修復 qwen4exp 的測試(PR #29819)。該版本繼續提供 macOS Apple Silicon(arm64)與 Intel(x64)、iOS XCFramework 預編譯包,Linux 與 Windows 覆蓋 CPU、Vulkan、CUDA 12.8/13.4、ROCm 10.0、OpenVINO、SYCL 等後端,另有 Android arm64 與 openEuler 版本。
llama.cpp releases● 精選10/4 01:37AI 評分63
llama.cpp 在 WebGPU 後端為 fill/set_rows 操作加入 f16 支援(PR #29897),併發布 b11382 版本。該版本覆蓋 macOS Apple Silicon、iOS、Linux、Android、Windows 等平台,其中 macOS Apple Silicon 的 KleidiAI 建置被停用。對使用 WebGPU 推理的使用者,f16 支援可減少視訊記憶體佔用並提升相容性。
llama.cpp releases10/3 14:27AI 評分35
llama.cpp 合併 PR #29904,通過改用融合 ADD 容差修復了 f16 精度下 ADD_ADD 測試偶發失敗的問題。該改動只涉及 CI 測試容差,不改變推理邏輯,但會隨下一次建置進入各平台發布包,包括 macOS Apple Silicon arm64、Ubuntu CUDA 12/13、Windows CUDA 12/13 等。
r/ClaudeAI top of the day10/3 16:14AI 評分51
一位法國傢俱廠運營總監用 Claude Code 在 30 天內做出生產管理系統,已上線供辦公室和車間每天使用。系統含 386 次提交、約 17.5 萬行 Python 與原生 JS、約 2100 個測試、約 580 個 API 路由、約 280 張 SQLite 表,技術棧為 FastAPI + SQLite + HTML/JS,跑在廠內 Windows 機器上。
r/LocalLLaMA top of the day10/3 07:49AI 評分51
有人在 Windows 上用 llama.cpp 的專家流式方案,在單張 RTX 5070 12GB 加 32GB DDR4-2400 記憶體上跑 Qwen3.8-Flash-Next 177B(UD-IQ3_XXS),基準約 11.5 tok/s,日常對話 14–15 tok/s,比原方案約 7 tok/s 提升明顯。一次長編碼提示以 10.15 tok/s 生成 4,892 個 token,產出一個可執行的單檔案貪吃蛇遊戲。
r/OpenAI top of the day10/3 21:13AI 評分62
多名 ChatGPT Pro 使用者報告 GPT-6 Astra 模型在 Chat 介面突然無法選擇,但在 Work 側仍可見。發帖者稱已連續數週用它進行詳細對話,Windows 應用和網頁端均消失,重啟與重新登入無效。有評論者表示已兩週無法選擇該模型,其訂閱為每月 100 美元方案;也有人質疑聊天側此前是否上線過 GPT-6 系列。