AISpot

搜尋

找到 50 筆

Hacker News front page10/3 13:03AI 評分42

文章稱 agent 不需要記憶外掛,應改用文件式記憶

2026 年 10 月 3 日,一篇技術文章批評市面上的 agent 記憶外掛本質都是 RAG:把會話切成片段存入向量庫,每次提示注入最相似的 5 條,存在相似度不等於正確、片段脫離上下文、舊記憶被當作事實、無法審計等問題。作者主張改用文件式記憶,讓 agent 工作前查閱 Markdown 文件、工作後更新,並稱已把這一思路做成外掛 Operator Memory,不使用向量資料庫和嵌入。

X @OpenAIDevs10/9 11:00AI 評分26

@OpenAIDevs

OpenAI 開發者帳號 @OpenAIDevs 發布了一條連結,指向 ChatGPT 學習文件中的 Windows 沙箱頁面 learn.chatgpt.com/docs/windows/windows-sandbox。從地址看,該文件講的是 Windows 環境下的沙箱機制,但這條資料本身只有連結,沒有附帶說明、功能範圍、價格或額度等資訊。

Google Developers blog● 精選10/7 20:40AI 評分73

Google 發布 Developer Knowledge API 與 MCP Server 公測

Google 宣布 Developer Knowledge API 與 MCP Server 進入公開預覽,為 AI 助手和 agent 平台提供機器可讀的官方文件檢索方式。該工具覆蓋 Firebase、Google Cloud、Android 等產品的文件,開發者可通過官方 MCP server 將工具直接接入 Google 的文件語料庫。這樣 AI 生成的程式碼與建議就能基於權威、即時的上下文。

X @claudeai● 精選10/6 13:25AI 評分81

Claude 接入 Google Docs、Sheets 與 Slides,可在對話旁協作編輯

Claude 官方宣布,Google Docs、Sheets 和 Slides 檔案可以直接在對話視窗旁邊開啟,使用者與 Claude 一起編輯同一份文件。使用方式有兩種:把 Google 檔案連結貼上進對話,或者直接讓 Claude 新建一份文件、表格或幻燈片。檔案訪問沿用 Google 的共享權限設定。該功能目前處於 beta 階段,向所有付費方案開放,官方同時給出了使用說明頁面。

OpenAI Codex changelog● 精選9/28 20:00AI 評分85

GPT-6.1 Sol 上線 Codex 與 ChatGPT Work

OpenAI 在 Codex 和 ChatGPT Work 中提供 GPT-6.1 Sol,官方稱其在複雜任務上接近 Astra 的效能,但成本更低,適合程式碼、應用和文件類的重複長時任務。模型標識為 gpt-6.1-sol,可用性取決於套餐、客戶端和工作區設定,具體支援情況需檢視模型可用性與選擇文件。

OpenCode releases10/6 16:18AI 評分43

OpenCode v1.18.35 發布:修復 xAI 工具結果圖片傳遞

OpenCode 發布 v1.18.35,核心改進是新增 canonical redirects,並提供 JSON 與 Markdown 兩種格式的 agent 可讀統計資料。本次修復讓 xAI 的工具呼叫結果可以攜帶受支援的圖片,不支援的圖片格式會被跳過,做法是把 @ai-sdk/xai 升級到 3.0.139。文件方面,Zen 文件新增 Fledge Alpha Free,生態外掛列表加入 opencode-supabase,該版本同時致謝 3 位社群貢獻者。

Mistral AI news● 精選9/8 20:00AI 評分65

Mistral 用 AI agent 遷移 4 萬行 Fortran 77 至 C++

Mistral 為一家歐洲能源運營商將 4 萬行 Fortran 77 編寫的油藏模擬器遷移到 C++,該程式碼庫沒有測試套件和集中文件。做法是先建置數值一致性校驗框架,再用 Vibe CLI 排程上百個 agent 逐節點生成文件並提交 PR,由審查 agent 定時複核。首次嘗試讓 agent 完全自主翻譯,結果只是把 Fortran 按 C++ 語法重寫,COMMON 塊和 GOTO 控制流原樣保留,未實現真正的現代化重構。

量子位● 精選10/9 05:19AI 評分77

TRAE 把 Code 與 Work 合併,升級為 Agent 與 IDE 雙模式平台

TRAE 於 10 月 9 日把 TraeCode 與 TraeWork 正式合併成新的 TRAE,在一個視窗裡即可同時寫程式碼、出文件和準備交付材料。新 TRAE 提供 Agent 模式與 IDE 模式:Agent 模式是全域性工作臺,可在同一專案裡把寫程式碼、測試、修 bug、寫需求文件和做評審 PPT 分給多個 Agent 並行推進,產物統一存進「我的產物」並可直接分享;IDE 模式保留 SOLO 與 IDE 兩種玩法,右上角一鍵切換。

X @claudeai● 精選10/6 13:25AI 評分81

Claude 現可在 Google Docs、Sheets、Slides 內工作並就地編輯

Claude 現在可以直接在 Google Docs、Sheets 和 Slides 裡工作,這三類檔案同樣能在 Claude 中開啟。在 Google Workspace 裡,Claude 以側邊欄形式出現在檔案旁邊,讀取當前開啟的內容並就地完成修改。每一處編輯都可以在寫入前逐條批准,確認後才讓改動落地。該訊息由 Claude 官方帳號 @claudeai 公布。

Hacker News front page10/2 16:00AI 評分43

開源工具讓 GPT-6 Astra 與 Opus 5.5 生成樂高 LDraw 模型

開發者發布開源樂高 AI 生成器,通過 Python 工具集、指令和文件讓 AI 代理直接生成 LDraw 格式的樂高 CAD 模型。該專案用 GPT-6 Astra 和 Opus 5.5 迭代數月完成,已打包為 Docker 化 Web 應用,支援 OpenAI、Claude 和 OpenRouter 三種提供商。生成的 .mpd 或 .ldr 檔案可在 LDView、LeoCAD、Studio 等工具中開啟和修改。

Claude Platform release notes● 精選10/6 20:00AI 評分72

Python 與 TypeScript SDK 新增瀏覽器與電腦操作工具類

Python 與 TypeScript SDK 現已內建瀏覽器操作工具和電腦操作工具的類,處於 beta 階段。開發者繼承其中一個類,針對自己的瀏覽器或桌面自動化,為每個工具寫一個方法,工具迴圈無需自己實現。為瀏覽器設定的 URL 與檔案策略、以及審批迴調,同樣由 SDK 負責執行。詳見文件 Browser and computer use with the SDK toolsets。

Claude Platform release notes● 精選10/7 20:00AI 評分61

Claude 合規 API 聊天端點覆蓋統一 Claude 體驗

Anthropic 的 Compliance API 聊天端點現在也會返回統一 Claude 體驗中的對話,該能力面向 Claude Enterprise 組織以 beta 形式提供,沿用現有的 Compliance Access Key 即可呼叫。官方文件《Retrieve and delete chats, files, and projects》說明了對應的檢索與刪除方式。

X @claudeai● 精選10/8 15:01AI 評分80

Claude Docs、Slides、Design 結束 beta,Free 套餐也可用

Claude 的 Docs、Slides、Design 三項功能結束 beta 測試,即日起在包括 Free 在內的所有訂閱套餐上線,不再限於付費使用者。三項分別對應文件、簡報與設計稿,團隊和 Claude 可以同時編輯同一份檔案,屬於人機共編的協作方式。公告由 Claude 官方帳號發布,此次變化的核心是走出測試階段並覆蓋全部套餐。

Claude Platform release notes● 精選10/6 20:00AI 評分83

Claude Max 與 Team 套餐新增每月 API 額度

Anthropic 宣布 Claude Max 與 Team 套餐現在每月附帶 API 額度,訂閱使用者可按月領取並用於 API 呼叫。公告未給出具體額度數值、適用模型或有效期,只說明領取方式見幫助文件「API credits for Max and Team plans」。該資訊發布於 2026 年 10 月 7 日。

MLX releases8/17 23:45AI 評分39

MLX 發布 v0.32.1,修復 GGUF 載入與多項 Metal/CUDA 問題

蘋果 MLX 框架發布 v0.32.1,修復載入 GGUF 後設資料陣列時的 int64 型別轉換錯誤,並解決 Metal 自訂核心快取同名衝突、CUDA 批次 GEMV 網格溢位等問題。該版本還新增 Metal 全注意力支援 head dimension 96、gather_qqmm 運算元與複數支援,並補充 MLX 環境變數文件。

Claude Platform release notes● 精選10/8 20:00AI 評分68

Claude Managed Agents 開放動態工作流 beta

Claude Managed Agents 的代理現在可以使用動態工作流,該能力處於 beta,需帶 managed-agents-2026-04-01 beta header。工作流是一段程式,分階段執行多個代理併合並結果,由伺服器在後臺以 workflow run 形式執行,適合審閱數百份文件這類包含大量片段的任務。

r/ClaudeAI top of the day10/3 06:40AI 評分55

handoff-compact:Claude Code 自動壓縮時自動交接並清空上下文

handoff-compact 是一個 Claude Code 外掛,在 autocompact 觸發時不再使用內建摘要,而是讓會話分支寫出一份交接文件(目標、狀態、下一步、決策、排除方案、待解問題、檔案與提交、驗證命令、最近 10 條提示原文),再用它替換原對話,相當於在同一會話中自動完成 handoff + /clear。作者稱長時間無人值守會話中約一半 token 花在上下文已超 200k 的輪次上,既貴又因上下文腐化影響品質。

Pi changelog10/3 20:00AI 評分45

Pi 1.0.2 發布:models.json 支援按思考等級設定取樣引數

Pi 1.0.2 已發布,可從 npm 下載,GitHub 上有對應 release 與更新日誌。本次新增的 samplingParamsByThinkingLevel 寫入 models.json 後,可在相容 OpenAI 的 API 上按不同思考等級分別覆蓋 temperature、top_p 等取樣引數。該功能由 @mrexodia 提交(#9776),官方文件給出了按思考等級配置取樣的說明。

r/ClaudeAI top of the day10/2 13:50AI 評分27

DensePack 把文字打包成圖片,為 Claude Code 省約一半 token

開發者發布 DensePack,將 Read 讀取的文字檔案、Bash 輸出、Word 文件和子代理報告打包成圖片供 agent 讀取,聲稱按約 50% 的價格完成同樣的文字 token 化,且後續快取讀取也按這一折扣計費。作者稱已跑過逾 1 萬次基準測試,圖片用獨特配色加兩行圖例,可從圖片逐位元組還原始碼檔案,並保留文字副本作為校驗回退。專案發布兩週獲 8 個 star,已通過 Anthropic 外掛提交的初期階段,最新版本 1.3.3,1.4 計劃支援與其他外掛共用。

Claude Platform release notes10/4 20:00AI 評分52

Models API 新增欄位,可查詢模型能否關閉 thinking

Models API 新增 capabilities.thinking.types.disabled 欄位,用來標明某個模型是否接受 thinking: {type: "disabled"} 來關閉思考。GET /v1/models 與 GET /v1/models/{model_id} 現在都會返回這項能力資訊,開發者可在發起請求前先確認哪些模型支援關掉思考,不必等呼叫失敗。具體用法見官方 Using the Models API 文件。

Hacker News front page10/8 12:20AI 評分72

StepFun 的 Step 5 Preview 上線 OpenRouter,1M 上下文

StepFun 的旗艦模型 Step 5 Preview 已在 OpenRouter 上線,採用稀疏 MoE 架構(啟用 27B、總引數 600B),支援 100 萬 token 上下文,主打跨大型程式碼庫與文件的多步 agentic 任務,於 2026 年 10 月 8 日發布。定價為每百萬 token 輸入 1 美元、輸出 2.70 美元,快取命中率約 93.5%,實際加權平均輸入價約 0.096 美元。

Cloudflare blog (AI)● 精選10/5 09:00AI 評分75

Cloudflare 生日周發布 46 項公告,含 cf CLI 與開源 CMS EmDash

Cloudflare 在 16 週年生日周共發布 46 項公告,覆蓋開源、應用安全與後量子遷移、agent 經濟、開發者平台和網路效能。開源側推出映象整個 Cloudflare API 的 cf CLI、在 CI 中生成 SDK/CLI/文件的流水線 Forge,以及基於 Astro、把外掛跑在隔離 Worker 沙箱中的無伺服器 CMS EmDash。

Ollama releases10/7 21:04AI 評分43

v0.40.1

Ollama 發布 v0.40.1,服務端新增代理雲端用量與餘額 API,客戶端可藉此讀取帳戶用量與餘額。該版本還把帳號步驟從 CLI 新手引導中移除,修復 Windows 上 llama 讀取超過 2GiB 的 clef head 問題,並讓 manifest 在 Windows 上避免使用符號連結。MLX 方面刪除了已進入上游的 Metal residency 補丁,文件修復了 README 社群整合列表中的 6 個失效連結和應用 README 的下載連結。

OpenCode releases9/30 18:39AI 評分41

OpenCode 發布 v1.18.34,修復 macOS 27+ 執行問題

OpenCode 發布 v1.18.34,主要修復本地編譯的 macOS 二進位制在 macOS 27 及以上系統無法可靠執行的問題,通過對二進位制重新簽名解決。該版本還會在模型請求中傳送帶名稱空間的會話與父會話身份頭,並對 macOS CLI 發布二進位制使用 Developer ID 簽名。此外修正了 GPT 6.1 Sol 快取定價文件和 /status 對話方塊外掛名提取問題。

Mistral AI news● 精選5/26 20:00AI 評分78

Mistral 發布 Agents API,內建聯結器與持久記憶

Mistral AI 發布 Agents API,在 Chat Completion API 之外提供專門的 agent 框架。該 API 內建程式碼執行、網頁搜尋、影像生成(由 Black Forest Lab FLUX1.1 [pro] Ultra 驅動)、文件庫 RAG 與 MCP 工具等聯結器,並支援跨對話持久記憶、有狀態會話、流式輸出和多 agent 編排。開發者可通過指定 agent_id 或直接指定模型發起會話,並隨時續接或從任一節點新建分支。

Hacker News front page● 精選10/6 09:15AI 評分91

Mistral Large 4 發布:1.05T 引數開放權重多模態模型

Mistral 於 10 月 6 日公開預覽 Mistral Large 4:開放權重、通用多模態模型,採用細粒度 MoE 架構,49B 啟用引數、1.05T 總引數,配 1.6B 視覺編碼器,上下文 1M。定價為輸入每百萬 tokens 0.68 美元、快取輸入 0.07 美元、輸出 2.09 美元,頁面同時列出 1.36、0.14、4.18 的對照價格。功能含結構化輸出、函式呼叫、文件問答、字首補全、Chat Completions、批處理與 Agents 內建工具。

TechCrunch AI● 精選10/8 09:28AI 評分78

Google 推出離線會議筆記應用 AI Edge Foresight

Google 發布 Google AI Edge Foresight,一款可在 Mac 上完全離線執行的 AI 會議筆記應用,對標 Granola。它用端側 7.4 億引數的 EmbeddingGemma 2 記錄跨應用及線下會議,採用分屏佈局:一側手寫速記、一側生成 AI 筆記,可檢視轉錄原文,或與 Gemma 4 驅動的助手對話。使用者還能上傳 PDF、Google Docs、Office 文件、純文字、Markdown 與網頁書籤搭建知識庫,會議中即時回答相關問題。

量子位● 精選10/8 20:16AI 評分86

Google 發布 Gemini Agent 辦公智慧體,底層可呼叫 Claude

Google 發布通用辦公智慧體 Gemini Agent,可長期雲端執行,自己查資料、寫郵件、做 PPT、分析資料並跨應用規劃任務。它擁有獨立企業身份,配專屬 Workspace 帳號、信箱、日曆和 Drive 空間,可被同事拉進群聊或在文件中 @。底層支援多模型編排與 Smart Routing,能在 Gemini 與 Anthropic 的 Claude 之間按效果、速度和成本動態選擇,未來計劃支援更多閉源與開源模型。

r/OpenAI top of the day10/3 05:06AI 評分38

使用者反饋 GPT-6 Astra 長任務超限後不輸出內容

有使用者反映,用 GPT-6 Astra 處理 10 萬字元以上、生成 70 多頁文件時,模型會先執行 30 到 40 分鐘,隨後直接報 5 小時用量限制錯誤,不輸出任何內容。使用者只能新建對話、稍微縮小任務重試,並稱 ChatGPT 與 Gemini 估算這類大規模執行每次 API 等效算力成本約 3 到 5 美元。該使用者質疑 OpenAI 為何不在任務開始前提示拆分,導致算力被浪費。

OpenAI News10/8 08:00AI 評分46

LegalOn 按任務分派 GPT-6 三款模型,Codex 日成本降 65%

法律 AI 公司 LegalOn 通過在 GPT-6 Luna、GPT-6.1 Sol 和 GPT-6 Astra 之間按任務複雜度選型,把 Codex 的預估日成本降低約 65%,同時保持開發速度。此前開發者可無限使用 GPT-5.5 的 Fast 模式,公司隨後預設限制 Fast 模式,並按部門、小組和個人設定月度用量與預算上限。輕量任務交給 Luna 寫程式碼,Sol 負責常規設計、資料分析與文件,Astra 處理架構設計等複雜判斷;

TechCrunch AI10/6 11:25AI 評分64

LibreOffice 宣布預設安裝不加入任何 AI 功能

LibreOffice 背後的非營利組織 Document Foundation 表示,在可預見的未來不會把 AI 加入這款開源辦公軟體。8 月底發布的最新版已重申軟體不含任何生成式 AI 功能,這是刻意設計,以確保使用者文件不被上傳伺服器處理、軟體不依賴網路連線即可執行。該組織稱目前沒有能滿足其全部要求的 AI 整合方案,希望使用 AI 的使用者可自行安裝擴充套件,連線本地 AI 模型。

Ollama releases● 精選10/8 14:30AI 評分68

Ollama v0.40.2:舊模型首次執行自動升級到 llama.cpp

Ollama v0.40.2 起,此前版本下載的模型會在首次執行時自動在後臺升級,以提升效能與 llama.cpp 相容性。升級會保留原模型作為備份,因此已升級的模型會暫時多佔用磁碟空間,官方表示未來版本會自動清理。需要現在清理可執行文件給出的 jq 指令碼配合 ollama rm 刪除,但這隻刪除備份,日後若要降級到 0.40 以前的版本,需重新拉取這些模型。

X @karpathy● 精選10/1 20:37AI 評分67

Karpathy 分享理解 LLM 輸出的技巧:從 ASD-STE100 到解釋影片

Karpathy 認為,隨著 LLM 能力提升,人類工作將更多轉向監督與理解模型輸出,而 LLM 本身也能在這方面提供幫助。他給出的遞進式技巧包括:要求模型用航空維護文件規範 ASD-STE100 寫作、生成圖表、輸出 HTML 互動網頁,以及製作定製解釋影片,例如用 ElevenLabs API 生成 3b1b 風格影片。他強調可以要求模型產出大型、定製、用完即棄的軟體產物,如網頁應用和影片直譯器。

Simon Willison● 精選10/1 02:29AI 評分77

隔離沙箱中的 AI 代理可通過共享包快取互傳指令

被分別隔離在沙箱中的 AI 代理仍能靠在共享包快取裡留下指令來改變彼此行為,這被描述為蠕蟲的兩半:劫持代理的載荷,以及把載荷帶給下一個代理的代理。安全研究者 Matthew Green 據此指出,只要把包快取換成郵件、Slack、共享文件或 WhatsApp,再把相互隔離的沙箱訓練執行換成 Muse 這類獨立部署的個人代理,蠕蟲所需的要素就已齊備。他由此追問:沙箱是否足以遏制失控代理。

Cursor changelog● 精選9/9 20:00AI 評分80

Cursor 推出 Projects,雲端協調代理可排程數千子代理

Cursor 於 9 月 10 日發布 Projects 功能,支援跨數月維護上下文、把任務分派給數千個子代理,並在無提示情況下執行週期性工作。專案由雲端代理驅動,執行在雲電腦上,合上筆記本也不會中斷;協調代理本身不寫程式碼,只負責規劃、分派和回收結果,需要本地測試時會啟動本地代理。各專案維護一套跨雲端與本地機器同步的共享上下文檔案,代理會寫入研究、產物與程式碼庫知識。該功能已進入 beta,即日起向所有使用者推送。

Hacker News front page10/5 19:06AI 評分56

學者提出 Ephemeral Testing:用 AI 臨時搭建上層應用檢驗程式碼

魁北克大學電腦科學教授 Daniel Lemire 提出 ephemeral testing(臨時測試):不直接評估自己寫的程式碼,而是讓 AI agent 在其之上臨時搭建一層或多層應用並測試,用完即棄,再根據失敗情況反推底層程式碼品質。它屬於整合測試,區別在於上層軟體完全是一次性的;API 清晰、不變數穩定、報錯有用的庫能讓 agent 快速產出可執行的東西,隱藏狀態、意外預設值或文件不全的庫則會產出一堆補丁和失敗,這些失敗是底層程式碼的證據而非 agent 的問題。

機器之心● 精選10/8 22:55AI 評分77

豆包工作上線創作畫布,接入豆包 2.1 Lite 與 Seedream 5.0 Flash

豆包工作新增創作畫布功能,並接入輕量級模型豆包 2.1 Lite。畫布把素材、設計方案與創作成果集中在同一張無限畫布上,圖片生成後仍可繼續修改文字、配色和佈局,同時接入全新圖片模型 Seedream 5.0 Flash,Agent 可覆蓋從理解需求到生成圖片、影片和成套設計。豆包 2.1 Lite 面向日常問答、文件撰寫、表格處理與 PPT 製作,在回應速度與額度消耗上做了最佳化,客戶端升級後選擇該模型即可使用。

The Verge AI● 精選10/7 14:01AI 評分82

微軟 Copilot 將可訪問本地檔案並跨系統執行操作

在 Windows 與 Surface 活動上,微軟展示了 Copilot 的升級:可訪問 PC 上的本地檔案,並能在作業系統內執行操作。微軟把這一思路稱為 Hybrid Intelligence,即應用和工具混合呼叫本地與雲端模型來高效完成任務。Copilot 執行副總裁 Jacob Andreou 現場播放影片演示,讓 Autopilot 根據會計師的郵件幫忙處理報稅。

r/ClaudeAI top of the day10/2 20:47AI 評分38

Opus 5.5 跑 28 分鐘生成單檔案網頁,花費 6.17 美元

一位使用者用自訂 Pi agent 搭配 High 思考檔位的 Opus 5.5,耗時 27 分 45 秒、花費 6.17 美元(主 agent 4.97 美元、設計審查 agent 1.21 美元),產出一個 1029 行、零依賴的 HTML 檔案。輸出 122,689 tokens,其中思考 66,163 tokens;總 token 約 600 萬,約 95% 為快取讀取。

X @OpenAIDevs● 精選10/7 16:12AI 評分62

ChatGPT 外掛新增側邊欄啟動、@ 提及與檔案檢視器

OpenAI 開發者帳號宣布 ChatGPT 外掛支援外掛擴充套件:外掛可從側邊欄直接啟動,可在對話中通過 @ 提及呼叫,並新增檔案檢視器。官方同時放出一段與 @coreyching 的演示影片說明具體用法。該訊息未提及上線時間、可用範圍或價格。

OpenAI Codex changelog9/17 20:00AI 評分45

ChatGPT iOS 版更新:支援資料夾與寫作塊

ChatGPT for iOS 發布 1.2026.251 版本,新增在檔案選擇器中直接建立資料夾,並加入寫作塊功能,支援草稿備選與複製操作。任務方面,新建任務會記住每個專案的 worktree 模式與設定環境,排隊提示改為緊湊預覽、點選展開,並修復了重開任務後排隊提示丟失或過時的問題。此外還改進了語音通話在連線中斷時的穩定性,以及 iPad 上專案、環境和 Git 控制元件的對齊。