AISpot

LM Studio

10月2日星期五 · 2 則

  1. Kimi blog● 精選AI 評分83

    Kimi K2.6 開源,主打長程編碼與 agent swarm

    Kimi K2.6 已開源,可通過 Kimi.ai、Kimi App、API 和 Kimi Code 使用,主打長程編碼、長時間執行與 agent swarm。官方稱其在內部 Kimi Code Bench 上較 K2.5 顯著提升:一個案例是在 Mac 上用 Zig 實現並最佳化推理,4000+ 次工具呼叫、連續執行 12 小時、14 輪迭代後吞吐從約 15 升至約 193 tokens/sec,比 LM Studio 快約 20%;

  2. NVIDIA blog● 精選AI 評分72

    NVIDIA DGX Spark 增 64GB 版,10 月 23 日 4999 美元起

    NVIDIA DGX Spark 將新增 64GB 統一記憶體版本,10 月 23 日由 Acer、ASUS、Dell、Gigabyte、HP、MSI 開賣,起價 4999 美元,保留 GB10 Grace Blackwell 晶片、DGX OS 與完整 NVIDIA AI 軟體棧,可完全本地執行最高 1000 億引數模型。兩臺機器可用 QSFP 線經 ConnectX-7 直連,記憶體池化到 128GB,模型上限提到 2000 億引數;

9月24日星期四 · 1 則

  1. Ollama releases● 精選AI 評分70

    v0.34.4 發布:Qwen 3.8 與 Gemma 4 在 Apple Silicon 上提速

    v0.34.4 發布,更新了 llama.cpp、MLX 和 XGrammar,Qwen 3.8 的提示處理在 Apple Silicon 上更快,Gemma 4 會為每張圖片自動選擇最佳解析度以保留更多高畫質細節。思考模型的結構化輸出改為單次推理完成,速度更快也更可靠;同時修復了本地模型庫很大時偶發的 model not found 報錯,以及 macOS 應用在檢測 ChatGPT 或 Codex 是否執行時無回應的問題。

9月23日星期三 · 1 則

9月19日星期六 · 3 則

9月18日星期五 · 1 則

  1. LM Studio blog● 精選AI 評分82

    Inco AI 開源 Splash 引擎,最佳化 Apple Silicon 本地推理

    Inco AI 發布開源推理引擎 Splash,專為在 Apple Silicon 上本地執行 Qwen3.6-35B-A3B 與 Qwen3.8-27B 最佳化,已整合進 LM Studio Bionic 1.1.5 及以上版本。在 48GB M5 Pro 測試中,Qwen3.8-27B 短提示解碼約 74 tokens/s、32K 上下文 54 tokens/s,約為次快引擎的兩倍;四個併發請求合計吞吐 170 tokens/s,是次快引擎的 3.9 倍。

9月17日星期四 · 2 則

  1. LM Studio blog● 精選AI 評分68

    LM Studio Bionic 支援跨會話引用與內省

    LM Studio 的 Bionic 現在可以引用並內省(Introspection)過往會話,在輸入框用 @ 提及即可引用其他會話,跨專案也支援。內省是一組寫在內建 SKILL 裡的漸進披露工具,採用分層設計與截斷策略以節省上下文,能讀取持久化的會話記錄,找回 compaction 時被丟棄的設計決策、環境資訊等細節,因此在耗時數小時的長任務中更能遵守原定計劃。讀取其他會話需經權限彈窗批准,以避免跨會話汙染;讀取當前會話自身的 transcript 則無需批准。

8月17日星期一 · 1 則

  1. LM Studio blog● 精選AI 評分68

    LM Studio Bionic 新增 Agent Skills 支援

    LM Studio 的 Bionic 現已支援按 Agent Skills 標準(SKILL.md 檔案)使用、安裝和建立技能。在對話裡輸入 @ 可調出技能選擇器,Bionic 會讀取技能檔案再決定如何執行;也可以給一個網址讓它安裝,或把現成的 SKILL.md 放進 Settings > Skills。它還能複用你在 Codex、Claude Code 等應用裡已有的技能,在 Settings > Skills > Skills from other apps 中逐條開關。

8月10日星期一 · 1 則