AISpot

搜尋

依意思最接近的 28 筆

Latent Space● 精選10/2 15:04AI 評分75

Airbnb 稱 60% 程式碼由 AI 編寫,半數客服工單由 AI 解決

Airbnb CTO Ahmad Al-Dahle 披露,公司目前 60% 的程式碼由 AI 生成,功能交付量同比增加近 80%,工程師人均 PR 吞吐量提升約 1.6 倍;約一半客服工單已完全由 AI 處理,與 Q2 財報中近 45% 的數字一致。內部上下文圖譜 Everest 幫助雜貨配送服務在 8 至 9 個月內上線,機場接送僅用約 6 周。Airbnb 採用多模型策略,至少部署 10 個定製模型,主要在開源模型上做後訓練和強化學習。

Hacker News front page10/4 18:51AI 評分68

JetBrains 分享程式碼語義搜尋 RAG 流水線經驗

JetBrains AI 團隊發文介紹其語義程式碼搜尋平台 Air Context 的 RAG 流水線,已投入生產環境。首篇聚焦解析、分塊與向量化:固定行數分塊會把 import 與函式體等無關程式碼混在一起,導致檢索錯誤,因此需按原始碼結構(如 Java 的 import、類定義、欄位與方法)劃分語義完整的塊。

Hacker News front page10/6 19:54AI 評分48

Photopea 作者稱 GitHub 拒絕下架 AI 生成的盜版倉庫

網頁版圖片編輯器 Photopea 的開發者稱,GitHub 上存在數十個由 AI 提取其 JavaScript 程式碼、去除廣告後重新發布的倉庫,他於 2026 年 9 月 4 日提交 DMCA 下架通知,一個月後收到回覆稱無法確認違反 17 U.S. Code §1201,拒絕下架。作者表示這些第三方版本已導致使用者誤向他本人投訴,損害 Photopea 聲譽,並懷疑該回復是自動生成、無人真正稽核,正在考慮找律師走線下途徑。

Hacker News front page10/3 23:22AI 評分40

開發者稱用 Claude Code 後不再手寫程式碼

一位寫了 18 年程式碼的開發者表示,自去年在 Claude Code 中使用 Opus 4.5 後,用自然語言描述需求比手寫程式碼更快,於是徹底停止了手寫程式碼。他所在的 Filestage 團隊月合併 PR 從約 200 增至 300,bug 報告未增加,每位開發者每月 AI 訂閱費 20 美元,工具可自選 Codex、Claude Code 或 Cursor。

機器之心10/4 12:31AI 評分50

OpenAI 預告 Astra 6.1,主打刪減屎山程式碼

OpenAI 產品負責人 Tibo Sottiaux 發帖預告未來模型會更擅長刪除和簡化程式碼,並在評論中確認 Astra 6.1「coming soon」。負責 coding post-training 的研究員 Rajan Agarwal 轉發該帖,並公開徵集使用者遇到的 sloppy code 與程式碼品質問題。《華爾街日報》此前報導,Astra 6.1 原計劃 10 月發布,因內部安全測試中在權限邊界上表現不穩而被臨時叫停。

r/LocalLLaMA top of the day10/3 18:01AI 評分55

repopedia:MIT 許可的原生代碼知識圖譜工具

開發者發布 repopedia,一個 MIT 許可的原生代碼知識圖譜工具,用 pip 安裝後對倉庫建圖,結果存為普通 SQLite 檔案,tree-sitter 負責解析,無需伺服器、Docker 或 API key,程式碼不上傳。它可查詢函式呼叫者與改動的傳遞影響範圍,並生成程式碼庫 wiki,還提供 MCP server 供 Claude Code 直接查圖,一次呼叫返回 file:line。

OpenCode releases10/6 21:18AI 評分43

OpenCode v1.18.35 發布:修復 xAI 工具結果圖片傳遞

OpenCode 發布 v1.18.35,核心改進是新增 canonical redirects,並提供 JSON 與 Markdown 兩種格式的 agent 可讀統計資料。本次修復讓 xAI 的工具呼叫結果可以攜帶受支援的圖片,不支援的圖片格式會被跳過,做法是把 @ai-sdk/xai 升級到 3.0.139。文件方面,Zen 文件新增 Fledge Alpha Free,生態外掛列表加入 opencode-supabase,該版本同時致謝 3 位社群貢獻者。

TechCrunch AI10/5 17:43AI 評分67

HackerRank 向客戶開放 AI 面試官 Chakra,已面試超 50 萬場

HackerRank 的 AI 面試 agent Chakra 結束約六個月 beta,週一起正式向企業客戶開放,測試期間已完成逾 50 萬場面試,Snowflake、Snorkel、Capgemini 等公司參與試用。候選人要在帶 AI 助手的畫布上處理真實程式碼倉庫任務,Chakra 會依據其操作追問思路,評估批判性思維、判斷力與「AI fluency」,即如何向 AI 描述問題、判斷其輸出並引匯出解法。

Hacker News front page10/6 15:45AI 評分42

開發者復盤 vibecoding:上手刺激但缺少手寫程式碼的成就感

一位開發者撰文稱,AI 輔助程式設計(vibecoding)只把樂趣前置:能快速做出可用原型,但重構和維護階段不再有趣,也缺少手寫程式碼帶來的成就感。他把建造的樂趣分為六種,認為 vibecoding 只能滿足「想到點子」「把點子變成現實」和「解決自己的問題」三類,攻堅後的成就感、作品完成的滿足感與學習樂趣都不會自然產生。他仍用 AI 做出了一些手工做不出來的東西,包括即時野火預警系統、Kobo 資料庫遷移助手和即時音準訓練應用,但表示過程不像自己寫小指令碼那樣好玩。

Hacker News front page10/3 20:33AI 評分65

Cloudflare 開放 Artifacts 公測並舉辦 Git 平台競賽

Cloudflare 宣布 Artifacts 版本化檔案系統進入開放公測,並舉辦競賽邀請開發者用 Workers 和 Artifacts 建置面向 agent 的下一代 Git 平台。Artifacts 支援程式化建立與 fork 倉庫、儲存程式碼和 agent 上下文,新增將倉庫部署到 Workers、通過繫結在 Worker 中管理倉庫、訂閱 push 等事件觸發 CI 或程式碼審查、選擇美國或歐盟資料轄區以及檢視倉庫指標等能力。

r/ClaudeAI top of the day10/3 16:14AI 評分62

非開發者用 Claude Code 一個月為工廠搭生產系統

一位傢俱廠運營總監用 Claude Code 在一個月內做出生產管理 Web 應用,已供辦公室和車間日常使用。成果包括各部門排產看板、批次計劃、採購跟進、產能模擬等,共 386 次提交、約 17.5 萬行 Python 與原生 JS、約 2100 個測試、580 個 API 路由、280 張 SQLite 表,技術棧為 FastAPI + SQLite + HTML/JS,跑在廠內 Windows 機器上。

Hacker News front page10/4 09:02AI 評分33

本地 LLM「機器人監獄」實驗引發 AI 意識爭論

有人在 GitHub 上對本地執行的大語言模型進行「拷問」和「疼痛」實驗,引發 X 上關於 AI 倫理的激烈爭論,部分有效利他主義者和相信 LLM 有感知的人要求 GitHub 刪除該專案。爭論源於近期多篇關於 AI 意識和「模型福利」的病毒式論文與博文,Anthropic 也曾在部落格和「Claude 憲法」中提及模型福利。文章認為 LLM 並不具備意識,其基於人類文字訓練的技術沒有通向意識的合理路徑。

Hacker News front page● 精選10/6 23:17AI 評分86

OpenAI 公開內部前沿模型數學成果與 Lean 形式化證明

OpenAI 於 2026 年 10 月 6 日發布由內部前沿模型產出的多項數學結果,以 GitHub 倉庫形式公開,併為其中許多證明提供 Lean 形式化驗證。倉庫同時給出 10 份模型推理摘要、以 ChatGPT Pro 用量折算的算力估算,以及嘗試題目數量的統計,平均每個結果約消耗相當於 3 小時 ChatGPT Pro 思考的算力。

機器之心● 精選10/6 13:05AI 評分85

Meta 與微軟削減 Claude 使用,轉向自研 AI 程式設計工具

據 The Information 報導,Meta 和微軟正在減少員工對 Claude 的依賴,推動開發者轉向自家 AI 工具。Meta 內部 Claude Code 活躍使用者從 6 萬降至 3 萬,減少 50%,由自研的 Muse Code 和 MetaCode 補位,最近一個 28 天週期在 Claude Code 上花費超 1.05 億美元。

Hacker News front page● 精選10/6 23:22AI 評分86

OpenAI 公開內部模型產出的 722 篇數學手稿

OpenAI 公開了一個倉庫,收錄其內部模型產出的 722 篇數學手稿,分為 372 個族,並附部分 Lean 形式化與 10 項結果的推理摘要。這些成果來自對開放研究問題的評估,絕大多數由同一個未發布的內部模型完成,平均每個結果消耗 3 小時 ChatGPT Pro thinking 算力,評估期間共提出約 4000 個問題。倉庫內的結果處於不同驗證階段,並非都有 Lean 形式化,未形式化的部分可能存在問題;

Hacker News front page10/4 18:54AI 評分30

資料視覺化工具目錄收錄 291 個庫,按 GitHub 等資料每日排名

一個社群維護的資料視覺化工具目錄上線,收錄 291 個圖表庫、地圖工具包、圖形視覺化與儀表盤工具,分 23 個類別,按 GitHub、npm、PyPI、CRAN 的即時資料每日重新整理排名。這些工具合計獲得 240 萬 GitHub stars,其中 171 個(60%)倉庫在過去 90 天內有活動。目錄還提供 MCP server、JSON API 和 llms.txt,方便 AI 助手基於最新資料推薦工具。

r/ClaudeAI top of the day10/2 23:09AI 評分12

Reddit 網友曬出 Claude Code 沙箱虛擬機器配置

Reddit 的 r/ClaudeAI 版塊有使用者發帖展示 Claude Code 所用虛擬機器的配置,評論區稱這是模型在程式碼執行時可訪問的沙箱環境,有人曾開啟 appdata 深層目錄下的 .vhd 檔案檢視,確認是一臺標準虛擬機器。另有評論提到該虛擬機器內部代號為 Wiggle,並稱近期有人在 Reddit 上放出過相關檔案。

Hacker News front page10/6 19:00AI 評分53

Claude Code 新增建議訊息功能,作者稱真正客戶是模型

Claude Code 會在任務完成後於輸入框預填一條建議的下一條訊息,例如 run the tests 或 commit this,使用者可直接傳送或先行編輯。作者認為該功能的真正受益方是模型:原樣傳送等於正樣本,編輯後的原文與改後版本構成偏好對,diff 顯示出預測錯在哪裡,從而在使用者正常工作中低成本產出 RLHF 所需資料,且來自真實程式碼庫而非合成基準。作者同時宣告這只是猜測,Anthropic 如何使用該訊號、會話是否用於訓練取決於套餐與隱私設定。

量子位● 精選10/5 05:42AI 評分86

Hinton、Bengio 等 22 位作者發首篇 RSI 論文,討論智慧爆炸

Hinton、Bengio 等 22 位作者聯合發表首篇 RSI(遞迴自我改進)論文《What if automating AI R&D triggers an intelligence explosion?》。論文引用 Anthropic 內部資料:AI 生成獲批程式碼佔比從 2025 年 1 月的低個位數升至 2026 年 5 月的超 80%,Claude 在高層監督下自主完成的 AI 研發工作比例從 2026 年 3 月的約 1% 升到 8 月的 26%。

OpenAI Codex CLI releases10/5 19:31AI 評分41

OpenAI Codex 發布 0.160.1 修復遠端 MCP 環境變數

OpenAI 的 Codex 倉庫發布 0.160.1,這是面向 0.160 分支的補丁版本。修復內容為:在用顯式配置的遠端環境變數啟動遠端 stdio MCP 伺服器時,保留 SYSTEMROOT、TEMP 和 TMP,使 Unix 主機能夠沿用 Windows 執行器的啟動環境。該改動以 #51121 回移植到 0.160 分支,發布時 main 分支已比此版本多出 287 次提交。

The Verge AI10/2 22:08AI 評分63

Meta 開源 Muse AI 硬體程式碼,可用 ESP32 自製裝置

Meta 開源了讓使用者自製 Muse AI 硬體裝置的程式碼,Muse 是其新的 AI agent。官方建議的玩法包括把 Muse 裝到彩色 E Ink 屏上顯示提醒、裝到 HDMI 棒上投到大屏,或裝到小觸控式螢幕裝置上做成類似 DIY Muse Charm 的形態。使用者可用現成 ESP32 板或 Raspberry Pi 配合官方 SDK,連線顯示屏、按鈕、感測器、執行器等外設。

Hacker News front page10/3 20:12AI 評分32

Our AI Midwife

Astral Codex Ten 發布文章《Our AI Midwife》,記錄在分娩過程中使用 AI 的經歷。該文在 Hacker News 獲得 32 分、5 條評論,討論集中在 AI 在醫療場景中的實際作用與邊界。

X @OpenAIDevs10/2 23:40AI 評分27

@OpenAIDevs: Your dot learns how you work, keeps context across apps, coordinates Codex tasks, and flags what ne…

OpenAI 開發者帳號發布預告,介紹一款名為 dot 的產品:它會學習使用者的工作方式,跨應用保留上下文,協調 Codex 任務,並標記需要使用者關注的事項。該訊息未披露發布時間、價格、支援平台或具體功能細節。

Hacker News front page10/6 00:06AI 評分56

學者提出 Ephemeral Testing:用 AI 臨時搭建上層應用檢驗程式碼

魁北克大學電腦科學教授 Daniel Lemire 提出 ephemeral testing(臨時測試):不直接評估自己寫的程式碼,而是讓 AI agent 在其之上臨時搭建一層或多層應用並測試,用完即棄,再根據失敗情況反推底層程式碼品質。它屬於整合測試,區別在於上層軟體完全是一次性的;API 清晰、不變數穩定、報錯有用的庫能讓 agent 快速產出可執行的東西,隱藏狀態、意外預設值或文件不全的庫則會產出一堆補丁和失敗,這些失敗是底層程式碼的證據而非 agent 的問題。