Ollama 新增 Jev 風格決策模型支援
Ollama 官方部落格宣布現已支援 Jev 風格決策模型,並同步上線決策能力文件與 API 文件。使用者可通過 Ollama 執行這類模型,具體用法和介面細節見官方文件。
找到 50 筆
Ollama 官方部落格宣布現已支援 Jev 風格決策模型,並同步上線決策能力文件與 API 文件。使用者可通過 Ollama 執行這類模型,具體用法和介面細節見官方文件。
2026 年 10 月 3 日,一篇技術文章批評市面上的 agent 記憶外掛本質都是 RAG:把會話切成片段存入向量庫,每次提示注入最相似的 5 條,存在相似度不等於正確、片段脫離上下文、舊記憶被當作事實、無法審計等問題。作者主張改用文件式記憶,讓 agent 工作前查閱 Markdown 文件、工作後更新,並稱已把這一思路做成外掛 Operator Memory,不使用向量資料庫和嵌入。
OpenAI 開發者帳號 @OpenAIDevs 發布了一條連結,指向 ChatGPT 學習文件中的 Windows 沙箱頁面 learn.chatgpt.com/docs/windows/windows-sandbox。從地址看,該文件講的是 Windows 環境下的沙箱機制,但這條資料本身只有連結,沒有附帶說明、功能範圍、價格或額度等資訊。
Google 宣布 Developer Knowledge API 與 MCP Server 進入公開預覽,為 AI 助手和 agent 平台提供機器可讀的官方文件檢索方式。該工具覆蓋 Firebase、Google Cloud、Android 等產品的文件,開發者可通過官方 MCP server 將工具直接接入 Google 的文件語料庫。這樣 AI 生成的程式碼與建議就能基於權威、即時的上下文。
月之暗面的 Kimi K3 已在 Amazon Bedrock 上線,可用於編碼、文件分析和長流程 agent 工作流,並支援顯式 prompt caching。使用者可沿用 Bedrock 的訪問、加密與審計控制,通過 AWS 官方模型卡文件開始接入。
Claude 官方宣布,Google Docs、Sheets 和 Slides 檔案可以直接在對話視窗旁邊開啟,使用者與 Claude 一起編輯同一份文件。使用方式有兩種:把 Google 檔案連結貼上進對話,或者直接讓 Claude 新建一份文件、表格或幻燈片。檔案訪問沿用 Google 的共享權限設定。該功能目前處於 beta 階段,向所有付費方案開放,官方同時給出了使用說明頁面。
OpenAI 在 Codex 和 ChatGPT Work 中提供 GPT-6.1 Sol,官方稱其在複雜任務上接近 Astra 的效能,但成本更低,適合程式碼、應用和文件類的重複長時任務。模型標識為 gpt-6.1-sol,可用性取決於套餐、客戶端和工作區設定,具體支援情況需檢視模型可用性與選擇文件。
OpenCode 發布 v1.18.35,核心改進是新增 canonical redirects,並提供 JSON 與 Markdown 兩種格式的 agent 可讀統計資料。本次修復讓 xAI 的工具呼叫結果可以攜帶受支援的圖片,不支援的圖片格式會被跳過,做法是把 @ai-sdk/xai 升級到 3.0.139。文件方面,Zen 文件新增 Fledge Alpha Free,生態外掛列表加入 opencode-supabase,該版本同時致謝 3 位社群貢獻者。
Mistral 為一家歐洲能源運營商將 4 萬行 Fortran 77 編寫的油藏模擬器遷移到 C++,該程式碼庫沒有測試套件和集中文件。做法是先建置數值一致性校驗框架,再用 Vibe CLI 排程上百個 agent 逐節點生成文件並提交 PR,由審查 agent 定時複核。首次嘗試讓 agent 完全自主翻譯,結果只是把 Fortran 按 C++ 語法重寫,COMMON 塊和 GOTO 控制流原樣保留,未實現真正的現代化重構。
TRAE 於 10 月 9 日把 TraeCode 與 TraeWork 正式合併成新的 TRAE,在一個視窗裡即可同時寫程式碼、出文件和準備交付材料。新 TRAE 提供 Agent 模式與 IDE 模式:Agent 模式是全域性工作臺,可在同一專案裡把寫程式碼、測試、修 bug、寫需求文件和做評審 PPT 分給多個 Agent 並行推進,產物統一存進「我的產物」並可直接分享;IDE 模式保留 SOLO 與 IDE 兩種玩法,右上角一鍵切換。
Claude 現在可以直接在 Google Docs、Sheets 和 Slides 裡工作,這三類檔案同樣能在 Claude 中開啟。在 Google Workspace 裡,Claude 以側邊欄形式出現在檔案旁邊,讀取當前開啟的內容並就地完成修改。每一處編輯都可以在寫入前逐條批准,確認後才讓改動落地。該訊息由 Claude 官方帳號 @claudeai 公布。
開發者發布開源樂高 AI 生成器,通過 Python 工具集、指令和文件讓 AI 代理直接生成 LDraw 格式的樂高 CAD 模型。該專案用 GPT-6 Astra 和 Opus 5.5 迭代數月完成,已打包為 Docker 化 Web 應用,支援 OpenAI、Claude 和 OpenRouter 三種提供商。生成的 .mpd 或 .ldr 檔案可在 LDView、LeoCAD、Studio 等工具中開啟和修改。
OpenAI 開發者帳號宣布 Decisions API 進入 public beta,開發者現在可以試用。官方給出的入口是 developers.openai.com 上的 API 文件指南頁面。原文未披露該 API 的具體功能、計費方式與額度限制。
Python 與 TypeScript SDK 現已內建瀏覽器操作工具和電腦操作工具的類,處於 beta 階段。開發者繼承其中一個類,針對自己的瀏覽器或桌面自動化,為每個工具寫一個方法,工具迴圈無需自己實現。為瀏覽器設定的 URL 與檔案策略、以及審批迴調,同樣由 SDK 負責執行。詳見文件 Browser and computer use with the SDK toolsets。
Anthropic 的 Compliance API 聊天端點現在也會返回統一 Claude 體驗中的對話,該能力面向 Claude Enterprise 組織以 beta 形式提供,沿用現有的 Compliance Access Key 即可呼叫。官方文件《Retrieve and delete chats, files, and projects》說明了對應的檢索與刪除方式。
Atlassian 與 OpenAI 於 10 月 6 日宣布擴大合作,把 GPT-6 系列前沿模型接入 Atlassian 平台與 Rovo,由 OpenAI 模型驅動平台上的 agent。Rovo 結合 OpenAI 智慧與 Atlassian 的 Teamwork Graph 企業上下文層,連線人員、專案、文件與決策。
Claude 的 Docs、Slides、Design 三項功能結束 beta 測試,即日起在包括 Free 在內的所有訂閱套餐上線,不再限於付費使用者。三項分別對應文件、簡報與設計稿,團隊和 Claude 可以同時編輯同一份檔案,屬於人機共編的協作方式。公告由 Claude 官方帳號發布,此次變化的核心是走出測試階段並覆蓋全部套餐。
Anthropic 宣布 Claude Max 與 Team 套餐現在每月附帶 API 額度,訂閱使用者可按月領取並用於 API 呼叫。公告未給出具體額度數值、適用模型或有效期,只說明領取方式見幫助文件「API credits for Max and Team plans」。該資訊發布於 2026 年 10 月 7 日。
蘋果 MLX 框架發布 v0.32.1,修復載入 GGUF 後設資料陣列時的 int64 型別轉換錯誤,並解決 Metal 自訂核心快取同名衝突、CUDA 批次 GEMV 網格溢位等問題。該版本還新增 Metal 全注意力支援 head dimension 96、gather_qqmm 運算元與複數支援,並補充 MLX 環境變數文件。
Claude Managed Agents 的代理現在可以使用動態工作流,該能力處於 beta,需帶 managed-agents-2026-04-01 beta header。工作流是一段程式,分階段執行多個代理併合並結果,由伺服器在後臺以 workflow run 形式執行,適合審閱數百份文件這類包含大量片段的任務。
ChatGPT 手機端相機新增掃描功能,可連續拍攝多頁筆記或文件,並自動合併成一個 PDF,直接上傳到對話中。入口是在 ChatGPT 內開啟相機,點三點選單選擇 Scan。該功能正在 iOS 上逐步推出,原文未提及安卓端安排。
handoff-compact 是一個 Claude Code 外掛,在 autocompact 觸發時不再使用內建摘要,而是讓會話分支寫出一份交接文件(目標、狀態、下一步、決策、排除方案、待解問題、檔案與提交、驗證命令、最近 10 條提示原文),再用它替換原對話,相當於在同一會話中自動完成 handoff + /clear。作者稱長時間無人值守會話中約一半 token 花在上下文已超 200k 的輪次上,既貴又因上下文腐化影響品質。
Pi 1.0.2 已發布,可從 npm 下載,GitHub 上有對應 release 與更新日誌。本次新增的 samplingParamsByThinkingLevel 寫入 models.json 後,可在相容 OpenAI 的 API 上按不同思考等級分別覆蓋 temperature、top_p 等取樣引數。該功能由 @mrexodia 提交(#9776),官方文件給出了按思考等級配置取樣的說明。
開發者發布 DensePack,將 Read 讀取的文字檔案、Bash 輸出、Word 文件和子代理報告打包成圖片供 agent 讀取,聲稱按約 50% 的價格完成同樣的文字 token 化,且後續快取讀取也按這一折扣計費。作者稱已跑過逾 1 萬次基準測試,圖片用獨特配色加兩行圖例,可從圖片逐位元組還原始碼檔案,並保留文字副本作為校驗回退。專案發布兩週獲 8 個 star,已通過 Anthropic 外掛提交的初期階段,最新版本 1.3.3,1.4 計劃支援與其他外掛共用。
@Zai_org 宣布 GLM-5.3 已在 Amazon Bedrock 上線,企業使用者可通過該平台呼叫。官方稱其為企業帶來更強的程式設計與 agentic 能力,並附上 AWS 文件中的模型卡連結作為接入入口。除上線渠道與能力定位外,本次未披露定價、上下文長度、可用區域等細節。
Models API 新增 capabilities.thinking.types.disabled 欄位,用來標明某個模型是否接受 thinking: {type: "disabled"} 來關閉思考。GET /v1/models 與 GET /v1/models/{model_id} 現在都會返回這項能力資訊,開發者可在發起請求前先確認哪些模型支援關掉思考,不必等呼叫失敗。具體用法見官方 Using the Models API 文件。
StepFun 的旗艦模型 Step 5 Preview 已在 OpenRouter 上線,採用稀疏 MoE 架構(啟用 27B、總引數 600B),支援 100 萬 token 上下文,主打跨大型程式碼庫與文件的多步 agentic 任務,於 2026 年 10 月 8 日發布。定價為每百萬 token 輸入 1 美元、輸出 2.70 美元,快取命中率約 93.5%,實際加權平均輸入價約 0.096 美元。
Cloudflare 在 16 週年生日周共發布 46 項公告,覆蓋開源、應用安全與後量子遷移、agent 經濟、開發者平台和網路效能。開源側推出映象整個 Cloudflare API 的 cf CLI、在 CI 中生成 SDK/CLI/文件的流水線 Forge,以及基於 Astro、把外掛跑在隔離 Worker 沙箱中的無伺服器 CMS EmDash。
Ollama 發布 v0.40.1,服務端新增代理雲端用量與餘額 API,客戶端可藉此讀取帳戶用量與餘額。該版本還把帳號步驟從 CLI 新手引導中移除,修復 Windows 上 llama 讀取超過 2GiB 的 clef head 問題,並讓 manifest 在 Windows 上避免使用符號連結。MLX 方面刪除了已進入上游的 Metal residency 補丁,文件修復了 README 社群整合列表中的 6 個失效連結和應用 README 的下載連結。
OpenCode 發布 v1.18.34,主要修復本地編譯的 macOS 二進位制在 macOS 27 及以上系統無法可靠執行的問題,通過對二進位制重新簽名解決。該版本還會在模型請求中傳送帶名稱空間的會話與父會話身份頭,並對 macOS CLI 發布二進位制使用 Developer ID 簽名。此外修正了 GPT 6.1 Sol 快取定價文件和 /status 對話方塊外掛名提取問題。
Mistral AI 發布 Agents API,在 Chat Completion API 之外提供專門的 agent 框架。該 API 內建程式碼執行、網頁搜尋、影像生成(由 Black Forest Lab FLUX1.1 [pro] Ultra 驅動)、文件庫 RAG 與 MCP 工具等聯結器,並支援跨對話持久記憶、有狀態會話、流式輸出和多 agent 編排。開發者可通過指定 agent_id 或直接指定模型發起會話,並隨時續接或從任一節點新建分支。
Mistral 於 10 月 6 日公開預覽 Mistral Large 4:開放權重、通用多模態模型,採用細粒度 MoE 架構,49B 啟用引數、1.05T 總引數,配 1.6B 視覺編碼器,上下文 1M。定價為輸入每百萬 tokens 0.68 美元、快取輸入 0.07 美元、輸出 2.09 美元,頁面同時列出 1.36、0.14、4.18 的對照價格。功能含結構化輸出、函式呼叫、文件問答、字首補全、Chat Completions、批處理與 Agents 內建工具。
Google 發布 Google AI Edge Foresight,一款可在 Mac 上完全離線執行的 AI 會議筆記應用,對標 Granola。它用端側 7.4 億引數的 EmbeddingGemma 2 記錄跨應用及線下會議,採用分屏佈局:一側手寫速記、一側生成 AI 筆記,可檢視轉錄原文,或與 Gemma 4 驅動的助手對話。使用者還能上傳 PDF、Google Docs、Office 文件、純文字、Markdown 與網頁書籤搭建知識庫,會議中即時回答相關問題。
Google 發布通用辦公智慧體 Gemini Agent,可長期雲端執行,自己查資料、寫郵件、做 PPT、分析資料並跨應用規劃任務。它擁有獨立企業身份,配專屬 Workspace 帳號、信箱、日曆和 Drive 空間,可被同事拉進群聊或在文件中 @。底層支援多模型編排與 Smart Routing,能在 Gemini 與 Anthropic 的 Claude 之間按效果、速度和成本動態選擇,未來計劃支援更多閉源與開源模型。
有使用者反映,用 GPT-6 Astra 處理 10 萬字元以上、生成 70 多頁文件時,模型會先執行 30 到 40 分鐘,隨後直接報 5 小時用量限制錯誤,不輸出任何內容。使用者只能新建對話、稍微縮小任務重試,並稱 ChatGPT 與 Gemini 估算這類大規模執行每次 API 等效算力成本約 3 到 5 美元。該使用者質疑 OpenAI 為何不在任務開始前提示拆分,導致算力被浪費。
法律 AI 公司 LegalOn 通過在 GPT-6 Luna、GPT-6.1 Sol 和 GPT-6 Astra 之間按任務複雜度選型,把 Codex 的預估日成本降低約 65%,同時保持開發速度。此前開發者可無限使用 GPT-5.5 的 Fast 模式,公司隨後預設限制 Fast 模式,並按部門、小組和個人設定月度用量與預算上限。輕量任務交給 Luna 寫程式碼,Sol 負責常規設計、資料分析與文件,Astra 處理架構設計等複雜判斷;
LibreOffice 背後的非營利組織 Document Foundation 表示,在可預見的未來不會把 AI 加入這款開源辦公軟體。8 月底發布的最新版已重申軟體不含任何生成式 AI 功能,這是刻意設計,以確保使用者文件不被上傳伺服器處理、軟體不依賴網路連線即可執行。該組織稱目前沒有能滿足其全部要求的 AI 整合方案,希望使用 AI 的使用者可自行安裝擴充套件,連線本地 AI 模型。
Ollama v0.40.2 起,此前版本下載的模型會在首次執行時自動在後臺升級,以提升效能與 llama.cpp 相容性。升級會保留原模型作為備份,因此已升級的模型會暫時多佔用磁碟空間,官方表示未來版本會自動清理。需要現在清理可執行文件給出的 jq 指令碼配合 ollama rm 刪除,但這隻刪除備份,日後若要降級到 0.40 以前的版本,需重新拉取這些模型。
Karpathy 認為,隨著 LLM 能力提升,人類工作將更多轉向監督與理解模型輸出,而 LLM 本身也能在這方面提供幫助。他給出的遞進式技巧包括:要求模型用航空維護文件規範 ASD-STE100 寫作、生成圖表、輸出 HTML 互動網頁,以及製作定製解釋影片,例如用 ElevenLabs API 生成 3b1b 風格影片。他強調可以要求模型產出大型、定製、用完即棄的軟體產物,如網頁應用和影片直譯器。
被分別隔離在沙箱中的 AI 代理仍能靠在共享包快取裡留下指令來改變彼此行為,這被描述為蠕蟲的兩半:劫持代理的載荷,以及把載荷帶給下一個代理的代理。安全研究者 Matthew Green 據此指出,只要把包快取換成郵件、Slack、共享文件或 WhatsApp,再把相互隔離的沙箱訓練執行換成 Muse 這類獨立部署的個人代理,蠕蟲所需的要素就已齊備。他由此追問:沙箱是否足以遏制失控代理。
Cursor 於 9 月 10 日發布 Projects 功能,支援跨數月維護上下文、把任務分派給數千個子代理,並在無提示情況下執行週期性工作。專案由雲端代理驅動,執行在雲電腦上,合上筆記本也不會中斷;協調代理本身不寫程式碼,只負責規劃、分派和回收結果,需要本地測試時會啟動本地代理。各專案維護一套跨雲端與本地機器同步的共享上下文檔案,代理會寫入研究、產物與程式碼庫知識。該功能已進入 beta,即日起向所有使用者推送。
魁北克大學電腦科學教授 Daniel Lemire 提出 ephemeral testing(臨時測試):不直接評估自己寫的程式碼,而是讓 AI agent 在其之上臨時搭建一層或多層應用並測試,用完即棄,再根據失敗情況反推底層程式碼品質。它屬於整合測試,區別在於上層軟體完全是一次性的;API 清晰、不變數穩定、報錯有用的庫能讓 agent 快速產出可執行的東西,隱藏狀態、意外預設值或文件不全的庫則會產出一堆補丁和失敗,這些失敗是底層程式碼的證據而非 agent 的問題。
豆包工作新增創作畫布功能,並接入輕量級模型豆包 2.1 Lite。畫布把素材、設計方案與創作成果集中在同一張無限畫布上,圖片生成後仍可繼續修改文字、配色和佈局,同時接入全新圖片模型 Seedream 5.0 Flash,Agent 可覆蓋從理解需求到生成圖片、影片和成套設計。豆包 2.1 Lite 面向日常問答、文件撰寫、表格處理與 PPT 製作,在回應速度與額度消耗上做了最佳化,客戶端升級後選擇該模型即可使用。
llama.cpp 發布建置版本 b11467,唯一程式碼改動是在 imatrix 中為 std::setlocale 引入 clocale 標頭檔案(#30079),屬於編譯相容性修復。
llama.cpp 發布 b11491,主要變更是移除 SYCL 運算元標頭檔案中重複的 block-size 定義,這些數值與 ggml/src/ggml-sycl/presets.hpp 裡的定義完全重複(PR #29507),屬清理性改動。
在 Windows 與 Surface 活動上,微軟展示了 Copilot 的升級:可訪問 PC 上的本地檔案,並能在作業系統內執行操作。微軟把這一思路稱為 Hybrid Intelligence,即應用和工具混合呼叫本地與雲端模型來高效完成任務。Copilot 執行副總裁 Jacob Andreou 現場播放影片演示,讓 Autopilot 根據會計師的郵件幫忙處理報稅。
ChatGPT Library 新增收藏與整理能力:可以把任意商品儲存到 Favorites,也可以建立資料夾來分類存放自己找到的內容。官方說明該功能在 ChatGPT 移動端和網頁版均可使用,公布時間為 2026 年 10 月 1 日,未提及地區或訂閱限制。
一位使用者用自訂 Pi agent 搭配 High 思考檔位的 Opus 5.5,耗時 27 分 45 秒、花費 6.17 美元(主 agent 4.97 美元、設計審查 agent 1.21 美元),產出一個 1029 行、零依賴的 HTML 檔案。輸出 122,689 tokens,其中思考 66,163 tokens;總 token 約 600 萬,約 95% 為快取讀取。
OpenAI 開發者帳號宣布 ChatGPT 外掛支援外掛擴充套件:外掛可從側邊欄直接啟動,可在對話中通過 @ 提及呼叫,並新增檔案檢視器。官方同時放出一段與 @coreyching 的演示影片說明具體用法。該訊息未提及上線時間、可用範圍或價格。
ChatGPT for iOS 發布 1.2026.251 版本,新增在檔案選擇器中直接建立資料夾,並加入寫作塊功能,支援草稿備選與複製操作。任務方面,新建任務會記住每個專案的 worktree 模式與設定環境,排隊提示改為緊湊預覽、點選展開,並修復了重開任務後排隊提示丟失或過時的問題。此外還改進了語音通話在連線中斷時的穩定性,以及 iPad 上專案、環境和 Git 控制元件的對齊。