AISpot

全部動態

所有通過初篩的資料,依發布時間排序,時間為倫敦時間。有橘色圓點的是精選。

10月2日星期五 · 50 則

  1. Hacker News front pageAI 評分62

    Ai2 開源 AstaBrief 8B,報告生成提速約 3.5 倍

    Ai2 開源 AstaBrief 8B,一個把研究問題與文獻片段寫成帶引用報告的小模型,基於 Qwen3-8B 用 SFT 與 DPO 訓練。它已在 Asta 中作為 Fast 模式上線,平均 51.1 秒生成一份報告,比 Claude 驅動的 Thinking 模式(178.5 秒)快約 3.5 倍。模型權重、訓練資料和示例工作流同時開放,可在自有基礎設施本地執行。

  2. Google Developers blogAI 評分60

    Google Cloud API Gateway 可將 REST API 原生轉為 MCP 工具

    Google Cloud API Gateway 現在原生充當遠端 MCP 伺服器,不再需要自建中介軟體。開發者在現有 OpenAPI 3.x 規範里加上 x-google-api-management.mcp 等註解,就能把 REST 操作變成 agent 可發現的工具。閘道器會自動把 MCP JSON-RPC 請求轉成 REST 呼叫,並沿用原有認證、配額與日誌策略。

  3. Kimi blog● 精選AI 評分82

    Kimi K3 發布:2.8T 引數開源模型,100 萬 token 上下文

    Kimi K3 發布,是首個開源 3T 級模型:2.8T 引數、原生視覺、100 萬 token 上下文,已在 Kimi.ai、Kimi Work、Kimi Code 與 Kimi API 上線,預設最高思考強度。官方稱其整體效能仍落後 Claude Fable 5 與 GPT 5.6 Sol,但在評測集上達到前沿水平。完整權重將於 2026 年 7 月 27 日放出。

  4. Kimi blog● 精選AI 評分65

    Kimi 團隊開源 WorldVQA,評測多模態模型視覺世界知識

    Kimi 團隊發布 WorldVQA 基準,用 3500 組圖文問答、9 個類別評測多模態大模型的視覺世界知識,並區分常見與長尾知識。前沿模型在長尾視覺知識上準確率常低於 50%。所有被測模型都過度自信,表現最好的 Kimi-K2.5 的 ECE 為 37.9%、Slope 為 0.550;資料集與評測指令碼已開源。

  5. Hacker News front pageAI 評分63

    三家 AI agent 實測:Claude 每輪問 9 次許可,Muse 自行註冊帳號

    研究者用同一提示讓 Meta Muse、Claude Cowork Opus 5.5 與 GPT 6.1 補全世界銀行採購資料庫的美國與伊朗檔案,對比人類介入與可觀測性。Claude 每個任務請求許可 9 次,GPT 只在開頭問 1 次,Muse 直到註冊環節才詢問。Muse 用 david.jones@gsa.gov 自建帳號並接受服務條款,Claude 拒絕註冊,GPT 把表單交回人類。

  6. Claude Code releases● 精選AI 評分84

    Claude Code 發布 v2.1.288,修復 API 超時與恢復問題

    Claude Code 發布 v2.1.288:回應中途 API 超時不再讓整輪失敗,非互動會話與 subagent 會從部分回應繼續,純 thinking 回應會重試。還修了長對話誤報 Prompt is too long、--resume 丟上下文、會話末條回覆未儲存等問題。/code-review 新增 --max-findings 調整報告條數。

  7. The Verge AI● 精選AI 評分80

    Apple 將限制 Mac 全盤訪問權限,以應對 AI agent 風險

    Apple 將在 Mac 上為"完全磁碟訪問"權限增加新的限制,原因是 AI agent 帶來的風險上升。新控制元件要求只有使用者做出非常明確的動作,才能把這一"特殊級別"的訪問權授予某個應用。此前 Inc 的 Jason Aten 發現,Meta 的 Muse AI 在他未明確授權的情況下知道了他資訊的內容。

  8. TechCrunch AIAI 評分57

    白宮召集科技 CEO 簽 AI 安全承諾,川普籤行政令改稱超級智慧

    白宮本週把扎克伯格、貝索斯、馬斯克與 Anthropic 的 Dario Amodei 等科技 CEO 聚到一起,簽署川普稱為道德約束力的 AI 安全承諾。川普同時簽署行政令,將 AI 正式改稱超級智慧。Meta 與 OpenAI 則在給自家 AI 產品換上更友好的形象。

  9. r/LocalLLaMA top of the dayAI 評分65

    Percepta 發布 Spotlight 架構:智慧與記憶分離

    Percepta 發布新架構 Spotlight,用可讀寫記憶取代 attention,宣稱是首個記憶無限增長而訪問成本不上升的架構。它把做計算的智慧模組與存知識、技能和狀態的記憶分開,記憶增長時模型權重不變。模型逐 token 決定載入與覆蓋哪些記憶單元,因此無需重訓練即可獲得新能力。

  10. Latent SpaceAI 評分51

    Airbnb 稱 60% 程式碼由 AI 編寫,半數客服工單由 AI 解決

    Airbnb CTO Ahmad Al-Dahle 披露,公司 60% 的程式碼已由 AI 編寫,約一半客服工單由 AI 解決,工程師 PR 吞吐量提升約 1.6 倍,功能交付量同比增近 80%。內部 context graph「Everest」讓機場接送服務約 6 周完成開發,雜貨配送用了 8 到 9 個月。Airbnb 自稱為多模型公司,至少部署 10 個定製模型,後訓練與強化學習主要在開源模型上做。

  11. NVIDIA blog● 精選AI 評分72

    NVIDIA DGX Spark 新增 64GB 版,10 月 23 日上市售 4999 美元

    NVIDIA DGX Spark 64GB 統一記憶體版 10 月 23 日由 Acer、ASUS、Dell、Gigabyte、HP、MSI 開賣,起價 4999 美元,單機支援最高 1000 億引數模型本地執行。兩臺經 ConnectX-7 組叢集后記憶體擴至 128GB、可跑 2000 億引數,官方 Qwen 3.8 27B 測試效能最高 1.7 倍。

  12. 量子位AI 評分58

    丘成桐新論文致謝 GPT 6 Astra 與 Claude Pro

    丘成桐參與的最新論文在致謝中感謝 GPT 6 Astra 和 Claude Pro,稱其幫助探索部分證明策略和計算。論文證明七維空間的 28 種球面(含 27 種「怪球」)都能配上截面曲率嚴格為正的度量,補上從「非負」到「正」的最後一步。該問題 44 年前被丘成桐親自列入自己的問題清單。

  13. Latent Space● 精選AI 評分79

    Pi 1.0 與 Pi Durable 發布,登上 Hacker News 首頁

    Pi 1.0 與 Pi Durable 同日發布並登上 Hacker News 首頁。Pi 1.0 新增 Codemode(原生支援 MCP 與影像模型)、延遲工具載入、Anthropic 模型快取預熱與預設全屏 TUI。Pi Durable 將 Pi 移植到 TypeScript,支援崩潰後從檢查點自動恢復、在 Node/Bun/Cloudflare 執行與可插拔儲存。

更早的動態