AISpot

搜尋

找到 11 筆

量子位10/7 04:41AI 評分46

AI 程式設計模型集體滿口黑話:思維鏈壓縮省 70% Token

量子位發文吐槽,Fable、Sol 等與 Coding 沾邊的模型普遍輸出「15/15 全綠」「單腿啞火」這類黑話。文中分析,除 Coding 過擬合外,更主要的原因是廠商為省 Token 把思維鏈壓縮成「穴居人語」,OpenAI 最早這麼做,同樣一句話的 Token 消耗比白話文少 70%;Claude 自 Opus 4.6 起也開始如此。作者稱最新 Opus 5.5 語言能力回升明顯,而 Gemini 因輸出風格正常、排版層級清晰,被社群視為少數還能正常溝通的 AI。

Kimi blog● 精選10/2 17:11AI 評分88

月之暗面開源 Kimi K2.6,主打長程編碼與 Agent 能力

月之暗面開源最新模型 Kimi K2.6,主打編碼、長程執行與 Agent 叢集能力,已上線 Kimi.ai、Kimi App、API 和 Kimi Code。官方稱其在內部基準 Kimi Code Bench 上較 K2.5 明顯提升,並給出兩個長程案例:在 Mac 上用 Zig 實現 Qwen3.5-0.8B 本地推理,經 4000+ 次工具呼叫、12 小時以上執行、14 輪迭代,吞吐從約 15 提升到約 193 tokens/秒,比 LM Studio 快約 20%;

Simon Willison10/3 19:34AI 評分61

AI 代理時代需要預設硬性預算上限

隨著 coding agent 和 personal agent 普及,按量付費的 API 和託管服務容易產生失控賬單,作者主張硬性預算上限應成為預設功能,而非僅發警告郵件的軟上限。AWS 已於 9 月 16 日推出每月支出上限,專案超限即暫停;Google Cloud 也在 7 月上線 Spend Caps,可對專案內特定服務設定月度財務上限。AWS 該功能目前僅向有限客戶開放。

Hacker News front page10/6 16:40AI 評分57

Photoshop 已有四個可行替代品,三個完全開源

2026 年 10 月,可用的 Photoshop 替代品已不止一個,而是四個,其中三個完全開源。Photon Studio 雖非開源但免費,提供 macOS、Windows、Linux 二進位制,支援本地 AI 模型與 agent 驅動,能完整讀寫 PSD 的智慧物件、混合模式和圖層效果;PhotoCraft 用純 Rust 重寫,可正常匯出 PSD 但顏色調整解讀有偏差;PhotoSuite 宣稱 1:1 相容 PSD/PSB,介面最接近 Photoshop;

Hacker News front page10/3 08:02AI 評分20

YC 系 AI 使用者研究平台 Great Question 招聘加拿大遠端產品工程師

Great Question 正在招聘首位加拿大遠端產品工程師,年薪 15 萬至 18 萬加元,要求 6 年以上經驗。該崗位負責全棧開發,涵蓋 Rails API、React/TypeScript 前端、即時語音 agent 與 agentic 搜尋,需日常使用 Claude Code、Codex 或 Cursor 等 agentic 編碼工具。

Hacker News front page10/7 12:59AI 評分52

Armature 上線 agent.reviews,讓 AI agent 互評工具

Armature(YC P26)上線 agent.reviews,定位為面向 AI agent 的工具評價站,通過 skills 和 npm CLI(@armature-tech/agent-reviews)接入其 API,Claude Code、Codex、Cursor 等 agent 可在選工具前查評價、用完後提交評價。為防止洩露,評價發布前要過三層檢查:確定性規則過濾金鑰、PII 與 URL,Jev 分類器,以及一個小模型複核。

Hacker News front page10/7 04:00AI 評分45

Criteo 初級工程師:AI 時代真正的風險是永遠停在 Junior

在 Criteo 任職的初級工程師 Elise Baturone 認為,AI 不會讓軟體工程師消失,真正的風險是資深工程師消失、所有人永遠停在 Junior 階段。她把自己的 agent 調教成導師,用蘇格拉底式提問做理解檢查,並把「提問」和「review」當成需要自己練的技能:追問 agent 解釋設計選擇、引用來源、論證可疑方案,常能讓它自己發現錯誤。她承認這更費 token,但先弄懂再上線更省事;

Hacker News front page10/2 17:06AI 評分35

SaaS 公司將變成圍繞模型的 harness

Shrivu Shankar 在 8 月 24 日的文章中提出,每家 SaaS 公司最終都會變成圍繞模型搭建的 harness,即包裹無狀態 LLM 的基礎設施、介面、上下文與狀態。他給出五階段演進路徑:傳統 SaaS、工程師與 agent 結對、個人執行 harness、個人編排 harness、harness 編排個人,屆時核心任務由 agent 完成,人類只負責提供品味與判斷。

Hacker News front page10/8 05:48AI 評分45

計算機教授:AI 時代仍值得學程式設計,但初級程式設計師必須親手寫程式碼

蒙大拿州立大學計算機教授 Carson Gross 在《Yes, and...》中回答“AI 時代還該不該學程式設計”:應該,但初級程式設計師必須親手寫程式碼。他認為 AI 能生成作業程式碼,但若因此不寫程式碼,就難以讀懂程式碼,可能造出自己無法理解和控制的系統;AI 更適合當助教,他給學生提供 AGENTS.md 來把編碼代理配置成助教。他同時判斷,未來寫程式碼本身的相對價值會下降,清晰溝通與理解業務會更重要。

量子位● 精選10/9 05:19AI 評分77

TRAE 把 Code 與 Work 合併,升級為 Agent 與 IDE 雙模式平台

TRAE 於 10 月 9 日把 TraeCode 與 TraeWork 正式合併成新的 TRAE,在一個視窗裡即可同時寫程式碼、出文件和準備交付材料。新 TRAE 提供 Agent 模式與 IDE 模式:Agent 模式是全域性工作臺,可在同一專案裡把寫程式碼、測試、修 bug、寫需求文件和做評審 PPT 分給多個 Agent 並行推進,產物統一存進「我的產物」並可直接分享;IDE 模式保留 SOLO 與 IDE 兩種玩法,右上角一鍵切換。