AISpot

Ollama

近期事件

  1. 1
    熱度 0.83 個來源 · 4 則10/3 01:56

10月3日星期六 · 2 則

10月2日星期五 · 4 則

  1. Google Developers blogAI 評分64

    Google Antigravity SDK 新增本地模型與 Ollama 支援

    Google Antigravity SDK 現在支援在本地離線執行 agentic 工作流,可通過 LiteRT 執行 Gemma 4 26B A4B 等模型。SDK 還提供對 Ollama、vLLM 等 OpenAI 相容推理服務的開箱支援,便於搭建隱私優先的本地工具。官方描述的混合編排方式是:雲端模型只做輕量規劃器,程式碼審計、打補丁這類消耗大量 token 的任務交由裝置上的本地模型處理。

  2. Kimi blog● 精選AI 評分83

    Kimi K2.6 開源,主打長程編碼與 agent swarm

    Kimi K2.6 已開源,可通過 Kimi.ai、Kimi App、API 和 Kimi Code 使用,主打長程編碼、長時間執行與 agent swarm。官方稱其在內部 Kimi Code Bench 上較 K2.5 顯著提升:一個案例是在 Mac 上用 Zig 實現並最佳化推理,4000+ 次工具呼叫、連續執行 12 小時、14 輪迭代後吞吐從約 15 升至約 193 tokens/sec,比 LM Studio 快約 20%;

  3. NVIDIA blog● 精選AI 評分72

    NVIDIA DGX Spark 增 64GB 版,10 月 23 日 4999 美元起

    NVIDIA DGX Spark 將新增 64GB 統一記憶體版本,10 月 23 日由 Acer、ASUS、Dell、Gigabyte、HP、MSI 開賣,起價 4999 美元,保留 GB10 Grace Blackwell 晶片、DGX OS 與完整 NVIDIA AI 軟體棧,可完全本地執行最高 1000 億引數模型。兩臺機器可用 QSFP 線經 ConnectX-7 直連,記憶體池化到 128GB,模型上限提到 2000 億引數;

9月30日星期三 · 4 則

  1. X @ollama● 精選AI 評分75

    Ollama 新增 Jev 風格決策模型支援

    Ollama 在部落格中宣布現已支援 Jev 風格決策模型,並同步上線決策能力文件與 API 文件。使用者可通過 ollama.com/blog 檢視說明,在 docs.ollama.com/capabilities/decision 瞭解決策能力用法,API 細節見 docs.ollama.com/api/systemone。原文未披露具體模型名稱、效能資料與發布時間以外的限制。

  2. Ollama releases● 精選AI 評分76

    Ollama v0.35.0 加入決策模型,返回選擇與機率而非文字

    Ollama v0.35.0 新增決策模型支援,通過 /v1/systemone 端點呼叫,基於 TypeSafe 的 Jev API。這類模型不返回文字,而是返回選擇、機率和分數,適合工單分流、模型路由和內容分類;目前可用 Bespoke Labs 的 Nimble 和 Together AI 的 Tev1,用 ollama pull nimble 拉取。

9月29日星期二 · 2 則

  1. Ollama blog● 精選AI 評分82

    Ollama 0.35 支援 Jev 決策模型,本地低延遲

    Ollama 0.35 起支援基於 TypeSafe Jev API 的決策模型:通過新的 /v1/systemone 端點,把文字作為 state、配上一組命名問題,本機模型在一次請求裡全部作答,且無額外費用。首批三個模型為 Bespoke Labs 的 9B nimble,以及 Together AI 的實驗性 4B tev1 和 0.8B tev1:0.8b,用 ollama pull 即可下載,可通過 curl 或 TypeSafe 官方 Python SDK 呼叫。

9月25日星期五 · 1 則

  1. Ollama releases● 精選AI 評分86

    Ollama v0.40.0:Apple Silicon 上預設改用 MLX 執行模型

    Ollama 發布 v0.40.0,在 Apple Silicon 裝置上,MLX 執行時支援的模型架構會自動改用 MLX 執行,無需手動切換。用法與以往一致,例如 ollama pull qwen3.8 後 ollama run qwen3.8。該版本目前為預發布版(v0.40.0-rc0,變更範圍 v0.34.4 到 v0.40.0-rc0),官方稱預發布期間會測試並啟用更多模型,尚未說明具體支援清單與效能差異。

8月31日星期一 · 1 則

  1. Ollama blog● 精選AI 評分87

    Ollama 改用按 token 計費,Pro 每月 20 美元含 60 美元額度

    Ollama 於 2026 年 8 月 31 日推出按 token 計費的新 Pro、Max、Team 方案:Pro 每月 20 美元含 60 美元用量,Max 100 美元含 300 美元,Team 500 美元含 1000 美元共享額度且不限使用者數。新方案無服務費,也沒有 5 小時或每週上限,額度用盡後仍按同一 token 單價繼續計費,每月按訂閱起始日重置且不結轉。

8月25日星期二 · 1 則

  1. Ollama blog● 精選AI 評分80

    Ollama 支援作為閘道器接入 Claude Desktop

    Ollama 現在可作為第三方閘道器接入 Claude Desktop,開發者在 Ollama 中開啟 Claude 開關即可自動完成配置。連線後可選任意 Ollama 模型,包括本地執行的開放模型與 Ollama 雲端模型,也能隨時切回 Anthropic 模型;在 Ollama 裡關閉 Claude 即恢復原有設定。

8月11日星期二 · 1 則

  1. Ollama blog● 精選AI 評分90

    NVIDIA Nemotron 3.5 Lightning 上線 Ollama,可完全本地執行

    NVIDIA 的 30B 總引數(3B 啟用)開源模型 Nemotron 3.5 Lightning 已上線 Ollama,可完全在本地裝置執行。它採用混合 MoE 架構,支援最長 1M token 上下文,並用多 token 預測、DFlash 或 DSpark 投機解碼,吞吐達同類開源模型 4 倍、任務完成時間快 30%,面向呼叫工具、跑測試、檢索程式碼庫等長時 agent 任務。

8月10日星期一 · 1 則