AISpot

搜尋

找到 11 筆

Hacker News front page10/8 18:48AI 評分18

Spinal 發布:面向任意程式碼庫的近即時預測介面

Spinal 是面向任意程式碼庫的近即時預測介面,演示以 torvalds/linux(148 萬次提交、9.6 萬個檔案)為樣本。它能標出補丁的改動規模與影響範圍:KVM 檢查重複 vcpu_id 的提交 56 天后被回退;mm 移除 is_cow_mapping() 波及 arch、drivers、fs 等 7 個模組,+107/−38;net selftests 新增 380 行手寫程式碼覆蓋 UDP splice 校驗和分片對齊。

Hacker News front page10/8 12:20AI 評分72

StepFun 的 Step 5 Preview 上線 OpenRouter,1M 上下文

StepFun 的旗艦模型 Step 5 Preview 已在 OpenRouter 上線,採用稀疏 MoE 架構(啟用 27B、總引數 600B),支援 100 萬 token 上下文,主打跨大型程式碼庫與文件的多步 agentic 任務,於 2026 年 10 月 8 日發布。定價為每百萬 token 輸入 1 美元、輸出 2.70 美元,快取命中率約 93.5%,實際加權平均輸入價約 0.096 美元。

X @ggerganov● 精選9/4 11:30AI 評分96

NVIDIA 收購 Hugging Face,llama.cpp 承諾保持硬體無關

NVIDIA 已收購 Hugging Face。llama.cpp 作者 Georgi Gerganov 表示,NVIDIA 工程師已參與該專案程式碼庫一年多,並提供開發測試硬體;今後 llama.cpp/ggml 將繼續堅持硬體無關原則,所有後端的開發與支援仍由社群驅動,對所有人開放。他認為有 NVIDIA 和 Hugging Face 團隊支援,專案長期目標更易實現。

Claude blog● 精選6/17 20:00AI 評分80

Claude Code 新增 artifacts 功能,可生成即時共享網頁

Anthropic 於 2026 年 6 月 18 日宣布 Claude Code 支援 artifacts,能把會話中的工作進度轉成可即時更新、可分享的互動式網頁,如 PR 講解、系統說明、儀表盤和發布清單。artifacts 基於會話完整上下文建置,涵蓋程式碼庫、聯結器和對話本身,無需自行接入資料來源或搭建基礎設施;頁面原地重新整理,同一連結發布新版本並保留版本歷史。

Cursor changelog● 精選9/1 20:00AI 評分79

Cursor 推出自託管機器,工具執行留在自有網路

Cursor 上線自託管機器功能,程式碼庫、建置產物和金鑰全部留在自有基礎設施內,由 agent 在本地執行工具呼叫。支援動態池排程:My Machines 連線單檯筆記本或 VM,團隊池按需擴縮容、可休眠空閒機器並在重連視窗內恢復,且不繫結單一倉庫。雲端 agent 還可執行在 AWS Lambda、Cloudflare、Vercel、E2B 等既有沙箱上,自託管 worker 新增 Linux 與 Mac 的 computer use 支援。

r/LocalLLaMA top of the day10/3 13:01AI 評分55

repopedia:MIT 許可的原生代碼知識圖譜工具

開發者發布 repopedia,一個 MIT 許可的原生代碼知識圖譜工具,用 pip 安裝後對倉庫建圖,結果存為普通 SQLite 檔案,tree-sitter 負責解析,無需伺服器、Docker 或 API key,程式碼不上傳。它可查詢函式呼叫者與改動的傳遞影響範圍,並生成程式碼庫 wiki,還提供 MCP server 供 Claude Code 直接查圖,一次呼叫返回 file:line。

Mistral AI news● 精選9/8 20:00AI 評分65

Mistral 用 AI agent 遷移 4 萬行 Fortran 77 至 C++

Mistral 為一家歐洲能源運營商將 4 萬行 Fortran 77 編寫的油藏模擬器遷移到 C++,該程式碼庫沒有測試套件和集中文件。做法是先建置數值一致性校驗框架,再用 Vibe CLI 排程上百個 agent 逐節點生成文件並提交 PR,由審查 agent 定時複核。首次嘗試讓 agent 完全自主翻譯,結果只是把 Fortran 按 C++ 語法重寫,COMMON 塊和 GOTO 控制流原樣保留,未實現真正的現代化重構。

claude.dev blog● 精選9/28 08:00AI 評分77

Claude Code 的 claude-api skill 新增 build-eval 與 hillclimb 命令

Claude Code 的 claude-api skill 新增 build-eval 與 hillclimb 命令:前者在程式碼庫內搭建評測,後者針對該評測逐次改動應用,並用留出集防止過擬合。build-eval 會先訪談使用者,按生產記錄、bug 報告與支援工單、手寫案例的順序取樣輸入並生成頁面供確認,再挑選夠用的 grader——輸出受限時用程式化校驗,開放式輸出用 LLM-as-judge,評委模型不應是被測模型;

Cursor changelog● 精選9/9 20:00AI 評分80

Cursor 推出 Projects,雲端協調代理可排程數千子代理

Cursor 於 9 月 10 日發布 Projects 功能,支援跨數月維護上下文、把任務分派給數千個子代理,並在無提示情況下執行週期性工作。專案由雲端代理驅動,執行在雲電腦上,合上筆記本也不會中斷;協調代理本身不寫程式碼,只負責規劃、分派和回收結果,需要本地測試時會啟動本地代理。各專案維護一套跨雲端與本地機器同步的共享上下文檔案,代理會寫入研究、產物與程式碼庫知識。該功能已進入 beta,即日起向所有使用者推送。

Hacker News front page10/6 14:00AI 評分53

Claude Code 新增建議訊息功能,作者稱真正客戶是模型

Claude Code 會在任務完成後於輸入框預填一條建議的下一條訊息,例如 run the tests 或 commit this,使用者可直接傳送或先行編輯。作者認為該功能的真正受益方是模型:原樣傳送等於正樣本,編輯後的原文與改後版本構成偏好對,diff 顯示出預測錯在哪裡,從而在使用者正常工作中低成本產出 RLHF 所需資料,且來自真實程式碼庫而非合成基準。作者同時宣告這只是猜測,Anthropic 如何使用該訊號、會話是否用於訓練取決於套餐與隱私設定。