AISpot

Claude

10月3日星期六 · 2 則

  1. r/ClaudeAI top of the dayAI 評分29

    使用者求助:如何把 Claude 用到極致並搭建自動化生活系統

    一名大學生在 Reddit 發帖,稱自己每天用 Claude Pro 和 Claude Code,但感覺只發揮了其能力的一小部分。他列舉了當前用法:用 Claude Code 無程式設計背景搭建 DuckDB 分析資料庫、連線 Gmail/Calendar/GitHub/Drive/Notion、用 Otter 錄音後讓 Claude 提取要點,同時抱怨反覆重述上下文、未用 Claude Projects、Cowork、定時任務和 Chrome 擴充套件。

  2. r/LocalLLaMA top of the dayAI 評分37

    LocalLLaMA 討論 jev 分類模型的實際使用體驗

    r/LocalLLaMA 使用者分享 jev 系列分類模型(classifier)的真實用例:有人用 jev-reviewer 定位論文證據、避免引用幻覺,有人用 is-malicious 掃描 GitHub 倉庫與 PR 的惡意行為,還有人用 decider 4b 替代 Gemma 雙階段流程,把語音 RPG 延遲從 4-8 秒降到 2-3 秒。

10月2日星期五 · 24 則

  1. r/ClaudeAI top of the dayAI 評分55

    使用者用 Claude Opus 5.5 把 100 分鐘遊戲錄影剪成 50 分鐘成片

    一位業餘創作者用 Claude Opus 5.5 完成了整段影片剪輯:自動同步音畫、生成轉錄並據此把 100 分鐘素材剪到 50 分鐘、去除停頓、平衡音量、新增箭頭縮放閃回等效果,還把遊戲棋盤做成獨立畫面並生成動畫箭頭和 YouTube Shorts。整個過程不到一天,幾乎無需人工指導,且完全在 DaVinci 和 Premiere 之外完成。作者認為這不能替代優秀剪輯師的直覺,但對業餘創作者來說效果驚人。

  2. Hacker News front pageAI 評分62

    Ai2 開源 AstaBrief 8B 科學報告模型與訓練資料

    Ai2 開源 AstaBrief 8B:一個把研究問題與檢索到的文獻片段轉成帶引用報告的模型,基於 Qwen3-8B 用 SFT 與 DPO 訓練,權重、訓練資料和一份可從自己 PDF 生成報告的範例工作流一併放出。它已作為 Asta 的 Generate a report 功能中的 Fast mode 上線,與 Claude 驅動的 Thinking mode 並存;

  3. r/ClaudeAI top of the dayAI 評分32

    在 Blender 裡用 Claude Opus 5.5 畫草圖比寫提示詞更高效

    一位使用者在 Blender 中使用 Claude Opus 5.5 做 blockout 時發現,直接畫出空間意圖比用文字描述形狀更高效,因為文字擅長說明是什麼,卻不擅長表達位置、大小和數量。整個實驗共消耗 33M tokens,API 成本 16.07 美元,執行 48.5 分鐘,貼圖與夜空素材來自 Poly Haven 的 CC0 資源。作者因此不再用文字描述形狀,而是給 Claude 提供繪圖或空間參考。

  4. Hacker News front pageAI 評分63

    三款 AI agent 多語言實測:權限請求與註冊行為差異明顯

    技術與人權研究者 Roya Pakzad 發布對比測試,用世界銀行全球公共採購資料庫任務,分別以英文(美國)和波斯語(伊朗)在網頁版 Muse、Claude Cowork Opus 5.5、GPT 6.1 Sol 上執行。權限差異明顯:GPT 只在開頭請求一次網站訪問並提供允許所有相關網站選項,Claude 兩個任務各請求 9 次,Muse 到第四步才請求。

  5. Claude Code releases● 精選AI 評分84

    Claude Code 2.1.288 修復恢復會話丟失上下文與超時中斷問題

    Claude Code 發布 v2.1.288。修復了長對話報「Prompt is too long」卻不自動壓縮、--resume 丟失剛被壓縮恢復的檔案與上下文、恢復的會話不儲存該輪最後回覆,以及回應中途 API 超時導致整輪失敗——非互動會話與子代理現在會從部分回應繼續,僅有思考內容的回應會重試。

  6. Hacker News front pageAI 評分42

    開源工具用 GPT-6 Astra 與 Opus 5.5 生成 LDraw 樂高模型

    一位開發者發布了開源樂高 AI 生成器:一套 Python 工具、指令與文件,讓 AI agent 直接生成 LDraw 語言的樂高 CAD 模型。作者從去年 12 月開始試驗用 ChatGPT 和 Claude 寫 LDraw 程式碼,最終用 GPT-6 Astra 和 Opus 5.5 跑通,並打包成 Docker 化 Web 應用,可選 OpenAI、Claude、OpenRouter 三類提供方。

  7. r/LocalLLaMA top of the dayAI 評分52

    自託管 AI 並不省錢,博主稱仍會繼續本地部署

    使用者 basnijholt 在 Reddit 發帖並附上部落格文章,論證自託管 AI 並不比用 API 更省錢,但他表示自己照樣會做。他提出兩點:把 200 美元的訂閱(如 Opus 5.5、Astra)與 Qwen 3.8 27B 這類本地模型直接比價並不對等;他也不會把 200 GB 的郵件、聊天記錄和位置歷史交給 API,哪怕對方承諾零資料保留。帖子發出後引發了不少爭議。

  8. r/ClaudeAI top of the dayAI 評分50

    Claude Code 外掛 Claude Fables 把工具呼叫演成動畫

    免費開源的 Claude Code 桌面版外掛 Claude Fables 已發布在 GitHub,Claude 工作時它會觀察每次工具呼叫和每行輸出,每隔幾秒在輸入框上方用一段短動畫複述最新進展。Claude 是個橙色小生物,有 20 種動作、7 個場景和 11 種視覺風格,用 /fables style 切換;安裝只需把倉庫路徑寫進 ~/.claude/settings.json 的 CLAUDE_CODE_PLUGIN_DIRS 再重啟應用。

  9. r/ClaudeAI top of the dayAI 評分33

    r/ClaudeAI 討論:重度工作用 Opus 5.5,GPT 靠額度與畫圖

    r/ClaudeAI 一條 22 小時前的帖子問同時用 Claude 和 GPT 的人更偏好哪個,30 條評論後自動總結出的共識是:兩者都用,但嚴肅工作首選 Claude(尤其是 Opus 5.5),用於編碼、深度邏輯與科學任務;最大抱怨是 Claude Pro 額度消耗遠快於 GPT Plus。使用者繼續付費 GPT 的原因包括更寬鬆的訊息上限、DALL-E 影像生成,以及閒聊與頭腦風暴。常見工作流是先用 GPT 出想法和一般查詢,再切到 Claude 執行和打磨成品。

  10. r/ClaudeAI top of the dayAI 評分35

    團隊引入 Claude 後,衝刺幾天完成,管理層發愁找活

    一位負責企業系統開發的團隊負責人稱,團隊最近開始使用 Claude,原本按周計的衝刺現在幾天就能清空。其技術棧以 Python/TypeScript 為主,涉及大規模資料處理、DevOps 與微服務。團隊因此沒活可幹,產品管理部門難以找到更多工,他本人大部分時間花在規劃會議上,並在帖子中徵求對後續走向的猜測。

  11. r/ClaudeAI top of the dayAI 評分42

    DensePack 把文字打包成圖片,Claude Code 省一半 token

    DensePack 是一個 Claude Code 外掛,把 Read 讀取的文字、Bash 輸出、Word 檔案和子代理報告打包成圖片交給 agent 閱讀,按作者基準測試可省約 50% 的 token 費用,且後續快取讀取也按這個折扣計價。它用顏色編碼和兩行圖例,聲稱能從圖片逐位元組還原始碼檔案,並保留文字副本作為回退。專案發布兩週、獲 8 個 star,已通過 Anthropic 外掛提交的初期階段,最新版本 1.3.3,1.4 將支援與其他外掛共用。

  12. r/ClaudeAI top of the dayAI 評分30

    Opus 5.5 與 Sol 6.1 15 分鐘用 three.js 建布萊德湖城堡

    一位使用者用 15 分鐘限時提示,讓 Opus 5.5 和 Sol 6.1 分別用 three.js 建置可旋轉視角的簡化版布萊德湖城堡。Opus 5.5 用時 5 分 46 秒,約 300k 輸入加 18k 輸出 token,估算 API 成本約 1.56 美元;Sol 6.1 用時 11 分 2 秒,約 400k 輸入加 16k 輸出 token,估算約 0.96 美元。Opus 5.5 產出約 27 KB、520 行、3 個 CDN 指令碼;

  13. r/ClaudeAI top of the dayAI 評分30

    Opus 5.5 一次生成 19 美元瑞安航空航班逐幀動畫

    Reddit r/ClaudeAI 使用者 Efistoffeles 只給 Opus 5.5 一句提示詞,要求它用 JavaScript 逐幀畫出自己對一張 19 美元瑞安航空機票的看法,模型一次生成成功,耗時約 8 分鐘,程式碼以 Claude artifact 形式公開、可直接執行。評論區認為這段動畫像真實的瑞安航空降落,甚至有人誤以為飛機墜毀,作者回應“技術上算降落了”。他還在評論中表示,19 美元機票在歐盟相當常見。

  14. r/ClaudeAI top of the dayAI 評分23

    Reddit 使用者用同一提示詞對比 Sonnet 5.5 與 Opus 5.5 動效

    r/ClaudeAI 使用者 CFNStudio 給 Sonnet 5.5 和 Opus 5.5 同一個提示詞「為自己的模型做一支發布影片,告訴人們為什麼該用它」,並放出兩支成片供對比。評論裡有人指出提示詞太籠統,無法做嚴謹的橫向比較;有人追問底層用的是 Remotion 還是 FFmpeg,帖中未回答。一位自稱給客戶做動畫的從業者說這兩支動畫客觀上很差、目前只能靠改提示詞來編輯,不可交付;也有人回帖稱這種一次成型的進步很快,並且可以用 Remotion 之類的工具再編輯。

  15. r/ClaudeAI top of the dayAI 評分41

    r/ClaudeAI 熱議 Opus 5.5 被削弱

    Reddit 的 r/ClaudeAI 版塊出現熱帖,多數評論者認為 Opus 5.5 已被削弱(發帖人把 nerfed 誤寫成 nerded)。主流猜測是官方先用新模型拉訂閱、隨後降低算力省成本,同時讓下一代模型顯得更強;少數使用者稱模型仍正常甚至仍是最好的模型,品質下滑感來自上下文堆積、未新開對話。有人貼出 nerf 追蹤基準顯示輕微下滑,但被指仍在正常誤差範圍內;也有評論指出 Opus 5.5 發布當天就會說 load-bearing,不能當作降級訊號。

  16. r/ClaudeAI top of the dayAI 評分29

    Claude 以版權為由拒絕翻譯整本書

    多位 Reddit 使用者報告 Claude 現在會以版權為由拒絕翻譯受版權保護的書籍,即使只是個人自用。有使用者建議改為分批處理、只貼短段落請求解釋,或換用其他模型;也有使用者指出 Claude 在長文字翻譯中會「厭倦」並導致品質下降。另有使用者稱 Claude 甚至拒絕閱讀一本 1957 年、在多數地區已進入公有領域的書。

  17. Hugging Face blog● 精選AI 評分65

    Ai2 開源 AstaBrief 8B 科學報告生成模型

    Ai2 開源了 8B 的科學報告生成模型 AstaBrief,可把研究問題和檢索到的文獻片段直接寫成帶引用的報告。它已在 Asta 的 Generate a report 功能中以 Fast mode 上線,與 Claude 驅動的 Thinking mode 並列:Fast mode 平均 51.1 秒生成一份報告,Thinking mode 為 178.5 秒,快約 3.5 倍。模型基於 Qwen3-8B,用 SFT 加 DPO 訓練,一次成稿,跳過了片段摘要與聚類環節。

  18. 量子位AI 評分58

    丘成桐新論文致謝 GPT 6 Astra 與 Claude Pro

    丘成桐參與的最新論文在致謝中感謝 GPT 6 Astra 與 Claude Pro,稱兩者幫助探索了部分證明思路和計算。論文證明七維空間的 28 種球面(含 27 種怪球)都能配上截面曲率嚴格為正的度量,補上了 2020 年非負曲率結果到正曲率的最後一步;該問題是丘成桐 1982 年列進自己問題清單的第二位,已懸置約 70 年。論文附帶一套 SageMath 編寫的驗證程式碼,作者宣告人工驗證與論文寫作由自己負責,結論仍待數學界接受。

  19. Anthropic NewsAI 評分45

    Anthropic 投 1 億美元辦 Claude Frontier Academy,2027 年底前培訓 1 萬名工程師

    Anthropic 於 2026 年 10 月 2 日啟動 Claude Frontier Academy,投入 1 億美元,目標在 2027 年底前培訓 1 萬名 Frontier Deployed Engineer(FDE)。首批學員來自 Accenture、Bain、Capgemini、Commonwealth Bank of Australia、Deloitte、McKinsey、Morgan Stanley、Novo Nordisk 等企業,課程在舊金山、紐約和倫敦開班。

10月1日星期四 · 5 則

  1. X @AnthropicAIAI 評分56

    @AnthropicAI: In physics, an “impedance mismatch” occurs when two systems each work well but are poorly matched.

    Anthropic 發布 Science Blog 客座文章,哈佛物理學家 Matthew Schwartz 提出 AI 與科學之間存在類似物理學的“阻抗失配”:LLM 能力很強,但像對待人類合作者那樣使用它並非激發其科學優勢的最佳方式。為此他建置了一套用於定量科學精確計算的工具包,Claude 藉此發現了與生態學、群體遺傳學等十幾個領域的聯絡,Schwartz 再與領域專家合作把方向引導到有趣的問題上。

  2. Claude Code releases● 精選AI 評分78

    Claude Code v2.1.287 新增 Claude Mods 與 You should know 外掛

    Claude Code 發布 v2.1.287:新增 Claude Mods,外掛可以修改更深層行為;並內建 You should know,由側邊 agent 監視你或 Claude 可能遺漏的內容,用 /plugin enable cc-plugin-you-should-know@builtin 開啟(需第一方會話且開啟遙測)。agents 檢視新增 n:<text> 過濾器匹配會話名與任務;

  3. 量子位● 精選AI 評分80

    Google 突然發布 Gemini 4 Argon,多項榜單登頂

    Google 於 2026 年 10 月 1 日發布 Gemini 4 Argon,在 DeepSWE v1.1 長期軟體工程任務得 77.9%,高於 Claude Opus 5.5 的 74.2% 和 GPT-6 Astra 的 74.1%,並以 68.90% 登頂 Vals Index。定價為每百萬輸入 Token 2 美元、輸出 Token 10 美元,優惠期單題成本比 Astra 低約四成,輸出上限達百萬 Token。

  4. Anthropic NewsAI 評分45

    巴克萊銀行擴大與 Anthropic 合作,2026 年底 Claude Code 覆蓋半數開發者

    巴克萊銀行宣布擴大與 Anthropic 的戰略合作,在全行範圍部署 Claude,目標是 2026 年底 Claude Code 覆蓋其 50% 的開發者,2027 年覆蓋多數軟體工程師。已落地的應用包括:基於 RAG 的 Colleague Knowledge Assistant 自 2025 年上線,已有超 1.6 萬名員工使用、處理超 100 萬次搜尋;全球市場業務用 Claude 每天處理約 12 萬封客戶郵件,進行分類、資訊補全和路由判斷。

  5. Anthropic Research● 精選AI 評分68

    物理學家用 Claude 打造 BootLoops 科研工具

    理論物理學家 Matthew Schwartz 發布開源工具 BootLoops,把 Claude 當作 LLM 的"挽具",專攻適合當前 AI 的"Claude 形狀"問題。他用 Claude Fable 5 移植並改進散射振幅計算方法,還借 BootLoops 把數學物理技術帶到生態學、群體遺傳學、地質、經濟、語言學等領域,並與各領域專家合作篩選真正有價值的問題。BootLoops 開源,可搭配任意模型使用,但當前 AI 仍無法解決科學中的大多數問題。

9月30日星期三 · 4 則

  1. Latent Space● 精選AI 評分81

    OpenAI DevDay 發布 GPT-6.1 Sol、Dots 與 Agents API

    OpenAI 在 DevDay 上發布 GPT-6.1 Sol、個人助理產品 Dots,以及內建 Computer Use 的 Agents API,開發者可基於與 Codex、ChatGPT 相同的 Computer Use 建置應用。Ari Weinstein 稱 GPT-6.1 Sol 成本是 Astra 的五分之一,用在 Computer Use 上只需七分之一。

  2. Anthropic ResearchAI 評分55

    研究:機器人已能完成美國 34% 工時中的體力任務

    一項基於 O*NET 資料、用 Claude 評估任務暴露度的研究顯示,當今機器人已能完成美國 74% 的體力任務,佔全部工作時間的 34%;機器人與 LLM 合計覆蓋約 80% 的工作時間。但機器人僅在 0.3% 的任務上比人力更具成本競爭力,若價格按過去趨勢下降,40 年後這一比例才到 10%。暴露於機器人的崗位多為男性、低學歷、低薪,如駕駛與倉儲;護理與維修類崗位暴露度低。

9月29日星期二 · 4 則

  1. Simon Willison● 精選AI 評分73

    Anthropic 紅隊:GLM-5.3 在 4% 任務中實現控制流劫持

    Anthropic Frontier Red Team 在內部 Binary Exploitation 基準中隨機抽取 100 個任務評估多個模型:GLM-5.3 在 4% 的試驗裡實現了完整控制流劫持,Claude Mythos Preview 為 6%。此前模型 Claude Opus 4.6 與 GLM-5.2 在這些任務中一次都沒有成功。該團隊認為,GLM-5.3 的成績雖低於 Claude Mythos Preview,但一個有意義的能力門檻已被跨過。

  2. X @AnthropicAIAI 評分33

    Anthropic 啟動 AI 期望調研,Claude 使用者可參與

    Anthropic 於 9 月 29 日至 10 月 6 日開展新一輪 AI 調研,Claude 與 Claude Code 的 Free、Pro、Max 使用者均可參加,參與者可選擇公開自己的回答。去年 12 月的同類研究有 81,000 人參與,Anthropic 稱這是迄今規模最大的定性研究。調研結果將影響 The Anthropic Institute 的研究方向與公司決策,若多人提出 Anthropic 應改變做法,這些意見會被公開記錄。

  3. Anthropic ResearchAI 評分27

    Anthropic 用 AI 訪談徵集公眾對 AI 的看法

    Anthropic 於 2026 年 9 月 29 日啟動新研究,用 Anthropic Interviewer 訪談使用者對 AI 的真實體驗與期待,參與者可自願將完整訪談公開。訪談問題包括最有意義的正面與負面經歷、希望 AI 改變的工作教育醫療政府等領域、以及對 AI 公司的要求;公開版本只附國家,不含 Claude 帳號姓名與信箱,但官方明確警告他人仍可能通過年齡、職業、城市等細節重新識別身份,且一旦公開無法刪除已被他人儲存的內容。

  4. Anthropic Research● 精選AI 評分81

    GLM-5.3 可自主建置端到端漏洞利用,防護易被繞過

    智譜 AI(海外稱 Z.ai)的 GLM-5.3 具備自主建置端到端網路漏洞利用的能力,且發布時未設有效防護,Anthropic 測試顯示攻擊者用簡單技巧即可在 64% 到 100% 的情況下繞過其防護。在 ExploitBench 上,GLM-5.3 於 410 次嘗試中成功開發出 50 次端到端利用,接近 Claude Mythos Preview 的 56 次;在內部二進位制利用基準中取得 4% 的完整控制流劫持,Claude Mythos Preview 為 6%。

9月28日星期一 · 1 則

更早的內容