AISpot

搜尋

找到 11 筆

MLX LM releases● 精選3/7 03:59AI 評分78

v0.31.0

MLX v0.31.0 已發布。新增 Qwen 3.5 張量並行與 JoyAI LLM Flash 模型支援,並修復 Qwen 3.5 fp32 轉換、MiniMax M2.5 分片 RMS Norm 等問題。快取與視訊記憶體管理有多項改進,server 新增 --prefill-step-size 引數並支援返回 cached_tokens。

Ollama releases● 精選9/29 19:10AI 評分65

v0.35.1-rc0:Modelfile 新增 CAPABILITY 宣告與 capabilities 欄位

v0.35.1-rc0 允許在 Modelfile 中宣告 CAPABILITY,並在 create 請求中增加 capabilities 欄位。這些宣告會在 GGUF、safetensors 的建立、繼承與 Modelfile 匯出中保留。排程 System One 請求前須先判定 capability,不再依賴 Qwen 架構與渲染器後設資料匹配;評分仍限 GGUF,MLX 執行時改動另行處理。

Ollama blog● 精選8/31 01:00AI 評分87

Ollama 雲服務改為按 token 透明計費並公佈新套餐

Ollama 於 8 月 31 日把 Pro、Max、Team 計劃改為按 token 透明計費。Pro 每月 20 美元含 60 美元用量,Max 100 美元含 300 美元,Team 500 美元含 1000 美元共享用量、不限使用者。新套餐無服務費與 5 小時或每週限額,支援 Claude Code、Codex,零資料保留。

NVIDIA blog● 精選10/2 14:00AI 評分72

NVIDIA DGX Spark 新增 64GB 版,10 月 23 日上市售 4999 美元

NVIDIA DGX Spark 64GB 統一記憶體版 10 月 23 日由 Acer、ASUS、Dell、Gigabyte、HP、MSI 開賣,起價 4999 美元,單機支援最高 1000 億引數模型本地執行。兩臺經 ConnectX-7 組叢集后記憶體擴至 128GB、可跑 2000 億引數,官方 Qwen 3.8 27B 測試效能最高 1.7 倍。

Ollama releases● 精選9/24 05:45AI 評分70

v0.34.4 更新:修復本地模型庫報錯,Apple Silicon 推理更快

v0.34.4 已發布。思考模型的結構化輸出改為單次通過,更快更可靠,並修復本地大模型庫間歇性報 model not found 及 macOS 應用檢查 ChatGPT、Codex 時卡死的問題。Qwen 3.8 在 Apple Silicon 上提示處理更快,Gemma 4 會按圖選最佳解析度以保留更多細節。