AISpot

搜尋

找到 15 筆

r/ClaudeAI top of the day● 精選10/3 02:29AI 評分78

使用者稱 Opus 5.5 周額度 3 億 token 即觸頂

一位使用者反映,改用 Opus 5.5 後每週僅用 3 億 token 就觸及訂閱週上限,而此前每週消耗 10 至 20 億 token 都沒問題。該使用者指出 Opus 5.5 單 token 價格理論上更低,懷疑是訂閱額度被削減,或與自己大量使用 subagent 的工作方式有關。目前這只是個人反饋,尚無官方說明。

r/ClaudeAI top of the day10/2 17:28AI 評分41

r/ClaudeAI 熱議 Opus 5.5 被削弱

Reddit 的 r/ClaudeAI 版塊出現熱帖,多數評論者認為 Opus 5.5 已被削弱(發帖人把 nerfed 誤寫成 nerded)。主流猜測是官方先用新模型拉訂閱、隨後降低算力省成本,同時讓下一代模型顯得更強;少數使用者稱模型仍正常甚至仍是最好的模型,品質下滑感來自上下文堆積、未新開對話。有人貼出 nerf 追蹤基準顯示輕微下滑,但被指仍在正常誤差範圍內;也有評論指出 Opus 5.5 發布當天就會說 load-bearing,不能當作降級訊號。

r/ClaudeAI top of the day10/2 17:52AI 評分30

Opus 5.5 一次生成 19 美元瑞安航空航班逐幀動畫

Reddit r/ClaudeAI 使用者 Efistoffeles 只給 Opus 5.5 一句提示詞,要求它用 JavaScript 逐幀畫出自己對一張 19 美元瑞安航空機票的看法,模型一次生成成功,耗時約 8 分鐘,程式碼以 Claude artifact 形式公開、可直接執行。評論區認為這段動畫像真實的瑞安航空降落,甚至有人誤以為飛機墜毀,作者回應“技術上算降落了”。他還在評論中表示,19 美元機票在歐盟相當常見。

r/ClaudeAI top of the day10/2 17:37AI 評分23

Reddit 使用者用同一提示詞對比 Sonnet 5.5 與 Opus 5.5 動效

r/ClaudeAI 使用者 CFNStudio 給 Sonnet 5.5 和 Opus 5.5 同一個提示詞「為自己的模型做一支發布影片,告訴人們為什麼該用它」,並放出兩支成片供對比。評論裡有人指出提示詞太籠統,無法做嚴謹的橫向比較;有人追問底層用的是 Remotion 還是 FFmpeg,帖中未回答。一位自稱給客戶做動畫的從業者說這兩支動畫客觀上很差、目前只能靠改提示詞來編輯,不可交付;也有人回帖稱這種一次成型的進步很快,並且可以用 Remotion 之類的工具再編輯。

r/ClaudeAI top of the day10/2 18:21AI 評分30

Opus 5.5 與 Sol 6.1 15 分鐘用 three.js 建布萊德湖城堡

一位使用者用 15 分鐘限時提示,讓 Opus 5.5 和 Sol 6.1 分別用 three.js 建置可旋轉視角的簡化版布萊德湖城堡。Opus 5.5 用時 5 分 46 秒,約 300k 輸入加 18k 輸出 token,估算 API 成本約 1.56 美元;Sol 6.1 用時 11 分 2 秒,約 400k 輸入加 16k 輸出 token,估算約 0.96 美元。Opus 5.5 產出約 27 KB、520 行、3 個 CDN 指令碼;

r/ClaudeAI top of the day10/3 02:55AI 評分15

使用者對比 Opus 5.5 與 Astra:Minecraft 模組品質差距明顯

一位理論物理博士生在 Reddit 發帖稱,Anthropic 提供 50% 折扣後他以 100 美元訂閱了 20x 方案,此前是 OpenAI 的 200 美元訂閱使用者。他用 Astra 生成的 Justice League Minecraft 模組品質很差,而 Opus 5.5 生成的飛行動畫流暢、平衡性好,還能一次性完成論文圖表和審稿回覆。他認為 Fable 比 Astra Ultra 或 Pro 稍弱,但 Ultra Pro 用處不大,已決定立即切換。

Claude Platform release notes● 精選9/22 01:00AI 評分89

September 22, 2026

Anthropic 發布 Claude Opus 5.5,面向長時間執行的 agentic coding 與知識工作,預設 1M token 上下文、128k 最大輸出,每百萬 token 輸入 $4、輸出 $20(Opus 5 為 $5/$25),已上線 Claude API、Amazon Bedrock、AWS、Google Cloud 與 Microsoft Foundry。

Hacker News front page10/2 21:00AI 評分42

開源工具用 GPT-6 Astra 與 Opus 5.5 生成 LDraw 樂高模型

一位開發者發布了開源樂高 AI 生成器:一套 Python 工具、指令與文件,讓 AI agent 直接生成 LDraw 語言的樂高 CAD 模型。作者從去年 12 月開始試驗用 ChatGPT 和 Claude 寫 LDraw 程式碼,最終用 GPT-6 Astra 和 Opus 5.5 跑通,並打包成 Docker 化 Web 應用,可選 OpenAI、Claude、OpenRouter 三類提供方。

X @karpathy● 精選8/2 04:00AI 評分67

Karpathy 用 Opus 5 把《魔戒》首段渲染成 3D 場景

Karpathy 給 Opus 5 輸入《魔戒》第一段、100 萬 token 預算(約 10 美元),讓它用 three.js 渲染這個故事。Opus 5 執行約 2 小時,寫出 5500 行程式碼,程式化生成了粗糙但可玩的 3D 場景。他指出這類任務沒人願意手工做,但 LLM 有無限耐心,成本近乎免費;同時也暴露 LLM 無法原生高效感知影片或玩遊戲,只能緩慢截圖自查,導致不少瑕疵。

r/ClaudeAI top of the day10/2 22:23AI 評分32

在 Blender 裡用 Claude Opus 5.5 畫草圖比寫提示詞更高效

一位使用者在 Blender 中使用 Claude Opus 5.5 做 blockout 時發現,直接畫出空間意圖比用文字描述形狀更高效,因為文字擅長說明是什麼,卻不擅長表達位置、大小和數量。整個實驗共消耗 33M tokens,API 成本 16.07 美元,執行 48.5 分鐘,貼圖與夜空素材來自 Poly Haven 的 CC0 資源。作者因此不再用文字描述形狀,而是給 Claude 提供繪圖或空間參考。

量子位● 精選10/1 16:02AI 評分80

Google 突然發布 Gemini 4 Argon,多項榜單登頂

Google 於 2026 年 10 月 1 日發布 Gemini 4 Argon,在 DeepSWE v1.1 長期軟體工程任務得 77.9%,高於 Claude Opus 5.5 的 74.2% 和 GPT-6 Astra 的 74.1%,並以 68.90% 登頂 Vals Index。定價為每百萬輸入 Token 2 美元、輸出 Token 10 美元,優惠期單題成本比 Astra 低約四成,輸出上限達百萬 Token。

Simon Willison● 精選9/29 23:20AI 評分73

Anthropic 紅隊:GLM-5.3 在 4% 任務中實現控制流劫持

Anthropic Frontier Red Team 在內部 Binary Exploitation 基準中隨機抽取 100 個任務評估多個模型:GLM-5.3 在 4% 的試驗裡實現了完整控制流劫持,Claude Mythos Preview 為 6%。此前模型 Claude Opus 4.6 與 GLM-5.2 在這些任務中一次都沒有成功。該團隊認為,GLM-5.3 的成績雖低於 Claude Mythos Preview,但一個有意義的能力門檻已被跨過。

Hacker News front page10/2 21:39AI 評分63

三款 AI agent 多語言實測:權限請求與註冊行為差異明顯

技術與人權研究者 Roya Pakzad 發布對比測試,用世界銀行全球公共採購資料庫任務,分別以英文(美國)和波斯語(伊朗)在網頁版 Muse、Claude Cowork Opus 5.5、GPT 6.1 Sol 上執行。權限差異明顯:GPT 只在開頭請求一次網站訪問並提供允許所有相關網站選項,Claude 兩個任務各請求 9 次,Muse 到第四步才請求。

r/LocalLLaMA top of the day10/2 20:17AI 評分52

自託管 AI 並不省錢,博主稱仍會繼續本地部署

使用者 basnijholt 在 Reddit 發帖並附上部落格文章,論證自託管 AI 並不比用 API 更省錢,但他表示自己照樣會做。他提出兩點:把 200 美元的訂閱(如 Opus 5.5、Astra)與 Qwen 3.8 27B 這類本地模型直接比價並不對等;他也不會把 200 GB 的郵件、聊天記錄和位置歷史交給 API,哪怕對方承諾零資料保留。帖子發出後引發了不少爭議。