AISpot

搜尋

找到 13 筆

Hacker News front pageAI 評分42

文章稱 agent 不需要記憶外掛,應改用文件式記憶

2026 年 10 月 3 日,一篇技術文章批評市面上的 agent 記憶外掛本質都是 RAG:把會話切成片段存入向量庫,每次提示注入最相似的 5 條,存在相似度不等於正確、片段脫離上下文、舊記憶被當作事實、無法審計等問題。作者主張改用文件式記憶,讓 agent 工作前查閱 Markdown 文件、工作後更新,並稱已把這一思路做成外掛 Operator Memory,不使用向量資料庫和嵌入。

機器之心AI 評分42

OpenAI 將 RSI 列為戰略目標,MemoraX 展示記憶驅動自進化

OpenAI 於 9 月 21 日發布官方戰略宣告,把自動化 AI 研究員與遞迴自我改進(RSI)列為下一階段重要目標,並計劃在 2028 年 3 月前打造真正的自動化 AI 研究員;Anthropic 同期披露,截至 8 月 Claude 已在約 26% 的內部 AI 研發工作中承擔主導角色。

Mistral AI news● 精選AI 評分78

Mistral 發布 Agents API,內建聯結器與持久記憶

Mistral AI 發布 Agents API,在 Chat Completion API 之外提供專門的 agent 框架。該 API 內建程式碼執行、網頁搜尋、影像生成(由 Black Forest Lab FLUX1.1 [pro] Ultra 驅動)、文件庫 RAG 與 MCP 工具等聯結器,並支援跨對話持久記憶、有狀態會話、流式輸出和多 agent 編排。開發者可通過指定 agent_id 或直接指定模型發起會話,並隨時續接或從任一節點新建分支。

Hacker News front pageAI 評分46

逆向工程後,AI Agent 跑在 48MB 記憶體的諾基亞 110 上

一位開發者把 AI Agent 跑在了只有 48MB RAM 的諾基亞 110 功能機上,並已用它自動化了幾個操作。他平時用這部手機來減少螢幕時間,最初嘗試刷入 Android 系統,因記憶體只有 48MB 而失敗,隨後花幾天時間逆向工程,最終讓 AI Agent 在這臺手機上執行。該帖發在 Hacker News 的 Show HN 板塊,目前 15 分、3 條評論,作者未說明所用的是哪個 AI 模型,也沒列出具體自動化了哪些操作。

Latent Space● 精選AI 評分65

Kubernetes 建立者推出雲原生 agent harness Mecatl

由 Kubernetes 建立者 Craig McLuckie 和 Joe Beda 創辦的 Stacklok 推出雲原生 agent harness Mecatl,6 月起在 GitHub 開源。Mecatl 把 agent loop 與客戶端、模型提供商、狀態儲存和執行環境解耦,會話與記憶不再以 JSONL 檔案躺在本地磁碟,而是放進雲端可管理的系統,供企業集中治理。

claude.dev blog● 精選AI 評分74

Anthropic 發布 agent 自動化參考實現,附 Claude Code 配置命令

Anthropic 發布基於 Claude Managed Agents(beta)的 agent 自動化參考實現:按 cron 計劃讀取 Slack 頻道與 GitHub PR,依據上次執行留下的書籤只取新增內容,再把簡報發到指定 Slack 頻道。配套程式碼含 agent、部署、環境、記憶與 vault 等配置,用 ant apply 寫入 Claude API 工作區,憑據存於 vault、沙箱內只留佔位符;

Claude blogAI 評分43

Cresta 用 Claude Agent SDK 打造 Conductor,部署時間減半

Cresta 基於 Claude Agent SDK 推出 Conductor,一個用自然語言建置其他 agent 的元 agent,早期用例把初始部署時間縮短約一半。它源自 Cresta 內部用 Claude Sonnet 與 Opus 做的早期版本,現已接入其對話智慧、評測與執行時,使用者描述需求後可從藍圖走到實現、評測與最佳化。建置者能把沉澱的模式、業務規則與評測方法存成可複用記憶並作為 skill 共享;

r/LocalLLaMA top of the dayAI 評分52

自建魔獸私服,讓 LLM 在瀏覽器裡玩遊戲

作者搭建了魔獸世界私服 jankcraft.xyz,並開發瀏覽器客戶端,PC 和手機均可免費遊玩。隨後用自訂 MCP 與 agent harness 通過 websocket 控制客戶端,讓 LLM 自動玩遊戲,agent 頁面已上線。本地模型需服務端開啟 CORS,作者自託管的幾個模型可能因用量增長下線;24GB 記憶體可跑 Qwen3.8-27B-GPTQ-W4A16,16GB 記憶體可用 vLLM 跑 Gemma4-e4b-coder。

Hacker News front pageAI 評分50

Talorys:一條命令把個人 AI 助手部署到自己的 Cloudflare 免費帳戶

開源專案 Talorys 發布,可用 npx create-talorys@latest 一條命令把單使用者個人 AI 助手部署進自己的 Cloudflare 帳戶,開發者不運營任何伺服器或資料庫。它提供帶工具呼叫的流式聊天、可檢視編輯的長期記憶、任務/筆記/專案管理,以及靠 Durable Object 定時觸發的提醒和每日摘要,聊天模型為 Workers AI 的 @cf/zai-org/glm-4.7-flash。

TechCrunch AIAI 評分56

盤點可通過簡訊使用的 AI 助手:Instinct、Caddy、Fambot 等

越來越多 AI 助手無需下載 App,直接通過 iMessage、RCS、SMS、WhatsApp 等簡訊渠道使用,可記憶上下文、連線已有應用並代為完成任務。Instinct 在 2026 年 9 月完成 10 億美元融資、估值達 100 億美元,仍處私測;Caddy 自 2026 年 4 月起公測;Fambot 2026 年 9 月初推出測試版並獲 350 萬美元 pre-seed 融資,測試期免費,未來擬收約一份 Netflix 訂閱的費用;

量子位● 精選AI 評分78

清華系星動紀元 VPP2 登頂 RoboDojo 模擬榜單

星動紀元自研世界動作模型 VPP2 登頂 RoboDojo 模擬榜單,平均成功率 32.26%、平均得分 39.26 分雙第一,高於 GPT-6-Astra 的 22.48% 和 28.97 分,泛化、精細操作、記憶三項同樣居首。真機 ALOHA 雙臂零樣本 10 類任務平均成功率 58.5%,9 類最佳,高於π0.5 的 40%。該模型未使用額外資料或 Agent RSI 等增強手段,靠三階段訓練解耦影片預測與動作學習,程式碼與專案主頁已開源。

量子位● 精選AI 評分76

DeepSeek 彈性計算團隊擴招,披露 DSec 沙盒基礎設施

DeepSeek 彈性計算團隊大量招聘,尤其需要資深工程師,併發布技術報告《DeepSeek 彈性計算(DSec):面向大規模 Agent 訓練的沙盒基礎設施》。DSec 支撐 DeepSeek-V4 全部訓練、評測和資料預處理,單個分片約 160 臺伺服器、3 萬 CPU 核心、250TB 記憶體,每天服務約 300 萬個沙盒,高峰線上超 38 萬個,每秒建立 5000 多個。團隊接下來要把 Agent 執行環境的數量和種類擴充成百上千倍。

r/LocalLLaMA top of the day● 精選AI 評分80

微軟發布 4B 程式設計智慧體模型 FrogNano

微軟推出 FrogNano-4B-2609,一個面向低視訊記憶體裝置的程式設計智慧體模型,基於 Qwen3.5-4B 後訓練而來。其額外訓練為純文字、聚焦倉庫級軟體工程,用約 1500 個合成 SWE 任務環境和基於可執行測試的獎勵做強化學習,不依賴更強模型的解題軌跡蒸餾。模型需配合 Leaf 工具框架生成結構化工具呼叫,產出的補丁須經人工審查、迴歸測試與安全驗證後才能使用。