llama.cpp b11418:server 支援 Clef 視覺輸入
llama.cpp 發布建置 b11418,其 server 新增對 Clef 的視覺輸入支援(PR #29969),並修復影像 token 上限、abort 與 yield_to_queue 資料變更等問題。
找到 10 筆
llama.cpp 發布建置 b11418,其 server 新增對 Clef 的視覺輸入支援(PR #29969),並修復影像 token 上限、abort 與 yield_to_queue 資料變更等問題。
llama.cpp 合併 PR #29903,通過將 n_batch 限制為不超過 n_ubatch 來修復 server 崩潰問題,對應 issue #29902。該修復由 Claude 輔助完成,並移除了相關測試與 embeddings 條件。新版本已覆蓋 macOS、Linux、Windows、Android 等平台,包括 Apple Silicon、CUDA、ROCm、Vulkan 等後端。
llama.cpp 發布 b11415,其 server 端現在會拒絕部分媒體截斷(partial media truncation)的請求。此次提交只保留 keep_first 修復,去掉了 mtmd 測試輔助改動——clip_image_f32_batch 改為按值儲存條目後該改動已無法編譯;同時刪除視覺測試,因為沒有測試夾具能在複用快取的情況下切到兩個相鄰媒體塊之間,該測試與修復本身無關。
OpenRouter 發布 openrouter:shell 伺服器工具和 Files API,任何模型都能在託管 Linux 容器中執行命令並讀寫檔案,兩項功能均處於 beta 階段。沙箱按每秒 0.0001 美元計費並計入請求費用,容器空閒 5 分鐘後休眠,網路預設關閉且策略啟動後不可更改。
llama.cpp 發布 v0.40.0-rc0,核心是為 llama-server 移除相容補丁做準備。該版本引入 manifest-list 儲存,讓不同 runner 的 manifest 共存於同一 tag,並保留 v1 tag 作為降級錨點;同時為舊版 Ollama GGUF 加入惰性本地相容遷移,轉為 llama.cpp 相容子模型,覆蓋已修補的模型家族,並保留解析器/渲染器、模板、投影器、媒體後設資料、分片 GGUF 及 MTP/draft 張量。
Pi pod 是一個圍繞 pi coding agent 建置的自託管沙箱執行環境,目標是補齊 agent 沙箱、原生客戶端、RBAC 會話共享和介面自動化等標準 agentic 工程能力。自託管版已開放倉庫可自行部署,託管服務尚未上線,官方計劃 v1 提供需綁卡的 7 天 Standard 試用(10 個活躍小時,之後 20 美元/月)或 50 美元/月的 Pro。
Google 公布 Private AI Compute 新架構,將在雲端加入持久化記憶層,實現跨裝置連續 AI 助手體驗,同時保持端側級別的隱私標準。資料加密存放在雲端專用儲存中,解密金鑰僅保留在使用者裝置上,Google 自身也無法讀取;模型需要呼叫時通過端到端加密通道進入硬體隔離的安全飛地,臨時解密、寫入新上下文後立即重新加密。此前該平台及業界同類方案均為無狀態,任務結束即清除上下文。
llama.cpp 的 server 元件新增了 /v1/systemone API,支援 laya、julia-1、lev、openjev、kev 五個模型。該 PR 包含模型轉換、服務端程式碼、共享提示字首、視覺支援,並新增 openjev tiny 模型用於測試。建置覆蓋 macOS、Linux、Windows、Android 等平台,但明確不支援 date_facts。
開發者發布 repopedia,一個 MIT 許可的原生代碼知識圖譜工具,用 pip 安裝後對倉庫建圖,結果存為普通 SQLite 檔案,tree-sitter 負責解析,無需伺服器、Docker 或 API key,程式碼不上傳。它可查詢函式呼叫者與改動的傳遞影響範圍,並生成程式碼庫 wiki,還提供 MCP server 供 Claude Code 直接查圖,一次呼叫返回 file:line。
一個社群維護的資料視覺化工具目錄上線,收錄 291 個圖表庫、地圖工具包、圖形視覺化與儀表盤工具,分 23 個類別,按 GitHub、npm、PyPI、CRAN 的即時資料每日重新整理排名。這些工具合計獲得 240 萬 GitHub stars,其中 171 個(60%)倉庫在過去 90 天內有活動。目錄還提供 MCP server、JSON API 和 llms.txt,方便 AI 助手基於最新資料推薦工具。