@claudeai: Haiku 5.5 is a significant step up over Haiku 4.5 across coding, computer use, and knowledge work.
Anthropic 官方帳號宣布推出 Claude Haiku 5.5。官方稱該模型在編碼、computer use 與知識工作三類任務上,相比 Haiku 4.5 有顯著提升。目前公布的資訊僅此一句對比結論,未提及價格、上下文長度、開放平台或具體評測資料。
依意思最接近的 30 筆
Anthropic 官方帳號宣布推出 Claude Haiku 5.5。官方稱該模型在編碼、computer use 與知識工作三類任務上,相比 Haiku 4.5 有顯著提升。目前公布的資訊僅此一句對比結論,未提及價格、上下文長度、開放平台或具體評測資料。
Anthropic 推出 Claude Haiku 5.5,這是 Haiku 系列首個帶可調 effort 設定的模型。使用者可以針對每個任務自行決定偏向成本還是偏向智慧:調低 effort 換取更低開銷,調高 effort 換取更強表現。訊息由官方帳號在 X 上公布,未提及價格、額度或可用平台等細節。
Anthropic 官方帳號表示,Claude Haiku 5.5 在幾乎全部對齊評估中相對 Haiku 4.5 都有明顯提升,出現不對齊行為的案例大幅減少。該訊息未披露具體的評估專案、分數、測試方法或發布時間等細節。
Anthropic 推出 Claude Haiku 5.5(claude-haiku-5-5),面向高併發與低延遲場景。該模型提供 1M token 上下文視窗、128k 最大輸出 token,並支援通過 effort 引數調節的自適應思考。已在 Claude API、Amazon Bedrock、AWS 上的 Claude Platform、Google Cloud 和 Microsoft Foundry 上線。
Claude 官方發布 Haiku 5.5,定位高併發、成本敏感型任務。官方稱其能穩定處理摘要、分類等重複性工作,並可搭配 Claude Opus 5.5 與 Sonnet 5.5,在 coding 任務中充當 subagent。該模型的速度也足以支撐即時客戶支援和瀏覽器操作。
Claude Haiku 5.5 現已上線,Anthropic 稱其覆蓋所有平台。公告列出的平台包括 Amazon Web Services、Google Cloud 和 Microsoft Azure,官方頁面提供更多資訊。
Anthropic 官方帳號於 10 月 7 日公布最新模型 Claude Haiku 5.5,目前公開資訊只有型號名稱和「our latest model」這一句描述。上下文視窗、價格、可用平台與上線時間等細節均未披露。後續需要等待官方補充規格說明。
Claude 官方帳號稱,Haiku 5.5 在 10 萬 token 以下的任務上價效比尤其突出。官方給出的依據是,這類任務約佔此前 Haiku 模型所收到請求的 90%,意味著絕大多數實際呼叫都落在這一區間內。該帖由 @claudeai 發布,未披露 Haiku 5.5 的具體價格、上下文長度或基準測試成績,也未與其他模型做對比。
Anthropic 發布 Claude Haiku 5.5,官方跑分逐項超過 GPT-6 Luna,成為新的小模型守門員。10 萬 token 以內的請求輸入輸出價格降 90%,超出部分降 50%,但換用新 tokenizer 後同一任務耗費 token 更多,實際省下的錢少於標價折扣。它首次支援 low 到 max 五檔 effort 調節,OSWorld 2.1 上 Low 檔準確率 42.0%、單次成本 $0.07,Max 檔 72.4%、$0.61;
Anthropic 發布小模型 Claude Haiku 5.5,官方稱其為迄今最便宜、最快、能力最強的小模型。該模型的平均執行成本比上一代 Claude Haiku 4.5 低約 75%。
Anthropic 發布 Claude Haiku 5.5,官方稱其是迄今最便宜、最快、能力最強的小模型,平均執行成本比 Haiku 4.5 低約 75%。定價為每百萬 token 輸入 0.10 美元、輸出 0.50 美元(提示 10 萬 token 以內),並首次在 Haiku 級模型上提供可調 effort 設定,用於權衡成本與智慧。
Anthropic 發布快速低價模型 Claude Haiku 5.5,10 萬 token 以內定價與 OpenAI 的 GPT-6 Luna 相同,均為每百萬 token 輸入 0.10 美元、輸出 0.50 美元,且基準分數更高。超過 10 萬 token 後 Haiku 漲價 5 倍,而 Luna 到 272,000 token 才小幅上調,長上下文場景 Luna 更划算。
Claude Code 發布 v2.1.293,新增 Claude Haiku 5.5(claude-haiku-5-5),現為 Anthropic API 上預設的 Haiku 模型,提供 1M 上下文,價格為每百萬 token 輸入 0.10 美元、輸出 0.50 美元,prompt 超過 100K 時升至 0.50/2.50 美元。
Hark 正式發布 AI 個人助理 Hark Pro,可免費使用,重度使用者另有訂閱檔。其底層是專門為操作電腦訓練的模型,能接入信箱、日曆、硬碟與信用卡等,替使用者完成數字任務;介面為全屏,中央是對話方塊,另有 prompt 資訊流與可定製 panels 小儀表盤。演示中它主動提醒待批費用、待回郵件與會議,並提議代訂機票,還曾替人完成加州 DMV 的車輛註冊續期,且會在小視窗展示瀏覽網頁的過程以建立信任。公司計劃 2027 年推出配套的 AI 原生硬體。
一位使用者僅向 Opus 5.5 提供創意、工作資料夾和音樂檔案,模型便自主完成了從調研到成片的全流程。它檢索了四年 AI 發展資料與素材,擷取文章和介面截圖,編寫 HTML 與動畫程式碼,用 Playwright 渲染畫面、FFmpeg 合成並加入音效,最終輸出完整影片。
Pi 1.1.0 發布,新增對 Claude Haiku 5.5(anthropic/claude-haiku-5-5)的支援,自適應思考可開到 xhigh/max,並在 Bedrock 上啟用提示快取。同時加入 OSC 7501 程式狀態上報,支援的終端與 agent 面板可看到 Pi 正在工作、被對話方塊或登入阻塞、完成還是失敗。
HackerRank 的 AI 面試 agent Chakra 結束約六個月 beta,週一起正式向企業客戶開放,測試期間已完成逾 50 萬場面試,Snowflake、Snorkel、Capgemini 等公司參與試用。候選人要在帶 AI 助手的畫布上處理真實程式碼倉庫任務,Chakra 會依據其操作追問思路,評估批判性思維、判斷力與「AI fluency」,即如何向 AI 描述問題、判斷其輸出並引匯出解法。
一位有基礎程式設計經驗的使用者稱,用 Opus 5.5 在約兩打提示詞內完成了一整款遊戲,包括玩法、畫面、音效與音樂,全程未寫一行程式碼;模型還能自寫測試、最佳化速度並修復觀察到的 bug。在室內導航對比中,Opus 5.5 的掃描與追蹤準確,Astra 開箱即用效果差,評分約 2/10 對 9/10。該使用者也指出 Claude 常提示工具使用過多或任務未完成,且超出額度後無法繼續使用。
OpenAI 產品負責人 Tibo Sottiaux 發帖預告未來模型會更擅長刪除和簡化程式碼,並在評論中確認 Astra 6.1「coming soon」。負責 coding post-training 的研究員 Rajan Agarwal 轉發該帖,並公開徵集使用者遇到的 sloppy code 與程式碼品質問題。《華爾街日報》此前報導,Astra 6.1 原計劃 10 月發布,因內部安全測試中在權限邊界上表現不穩而被臨時叫停。
Hinton、Bengio 等 22 位作者聯合發表首篇 RSI(遞迴自我改進)論文《What if automating AI R&D triggers an intelligence explosion?》。論文引用 Anthropic 內部資料:AI 生成獲批程式碼佔比從 2025 年 1 月的低個位數升至 2026 年 5 月的超 80%,Claude 在高層監督下自主完成的 AI 研發工作比例從 2026 年 3 月的約 1% 升到 8 月的 26%。
Artcraft 宣布從可控 AI 影像編輯轉向,一次推出七款開源應用,復刻 Adobe 的 Photoshop、Illustrator、Premiere、Lightroom、After Effects、InDesign 與 Acrobat Pro 的介面和工具。開發者 Brandon Thomas 稱這些「淨室替代品」由 Anthropic 的 Claude Opus 5.5 生成,用 Rust 編寫,並提供可在瀏覽器執行的 WebAssembly 版本。
Anthropic 於 2026 年 9 月 22 日發布由 Addy Osmani 撰寫的 Opus 5.5 使用指南,覆蓋 Claude 應用與 Claude Code。Opus 5.5 每次回覆前都會自行思考,無需再寫「think carefully」;它更擅長長時間多步驟任務,早期測試者可讓其連續數小時執行編碼任務。指南建議一次性給出完整任務與完成標準、在 CLAUDE.md 中寫明何時停下詢問、用子代理拆分大型審計或遷移,並把任務清單寫入檔案。
Splice CEO Kakul Srivastava 認為 AI 生成的郵件正在扼殺對話。她曾任職於 Flickr、Yahoo、GitHub 和 Adobe,目前執掌為音樂製作人提供取樣素材的 Splice,該平台的取樣曾出現在 Lisa 的《Money》和 Sabrina Carpenter 的《Espresso》等熱門歌曲中。她還主導了 Splice 收購 Spitfire Audio 並推動平台向新領域拓展。
Ai2 開源了 AstaBrief 8B,一個把研究問題與檢索文獻片段轉成帶引用報告的模型,基於 Qwen3-8B 訓練,已作為 Asta 的 Fast 模式上線。官方稱 Fast 模式平均 51.1 秒生成一份報告,比 Claude 驅動的 Thinking 模式 178.5 秒快約 3.5 倍。模型權重、訓練資料與範例工作流一併開放,機構可在自有基礎設施上本地生成報告。
量子位發文吐槽,Fable、Sol 等與 Coding 沾邊的模型普遍輸出「15/15 全綠」「單腿啞火」這類黑話。文中分析,除 Coding 過擬合外,更主要的原因是廠商為省 Token 把思維鏈壓縮成「穴居人語」,OpenAI 最早這麼做,同樣一句話的 Token 消耗比白話文少 70%;Claude 自 Opus 4.6 起也開始如此。作者稱最新 Opus 5.5 語言能力回升明顯,而 Gemini 因輸出風格正常、排版層級清晰,被社群視為少數還能正常溝通的 AI。
Astral Codex Ten 發布文章《Our AI Midwife》,記錄在分娩過程中使用 AI 的經歷。該文在 Hacker News 獲得 32 分、5 條評論,討論集中在 AI 在醫療場景中的實際作用與邊界。
r/ClaudeAI 上有使用者提問,若 Fable 5.5 下週發布,效能會有多大提升。評論區普遍擔心 Anthropic 會削弱現有的 Opus 5.5,多人稱 Opus 5.5 是目前最好的 coding agent 體驗,希望保留現狀。也有使用者認為 Fable 定位是複雜編排與一次性完成大功能,價格是 Opus 的兩倍,若提升不夠明顯則難以說服人升級。
《大西洋月刊》播客《The Permanent Questions》10 月 4 日發布一期對談,社會心理學家、《焦慮的一代》作者 Jonathan Haidt 在與 David Brooks 的對話中稱 AI 是「教育的中子彈」。該期節目在上月 Atlantic Festival 現場錄製,全長約 40 分鐘,話題還包括情緒在道德決策中的作用、如何設計出更少令人厭惡的精英階層等。影片發布於 The Atlantic 的 YouTube 頻道,目前約 2.8 萬次觀看。
Ai2 於 2026 年 10 月 2 日開源 AstaBrief 8B,一個把研究問題與檢索文獻片段轉成帶引用報告的模型,基於 Qwen3-8B 訓練,採用 SFT 加 DPO 而非強化學習。它已作為 Asta 的 Fast 模式上線,與 Claude 驅動的 Thinking 模式並列,整條流水線平均每份報告 51.1 秒,比 Thinking 模式的 178.5 秒快約 3.5 倍。
Apple 研究員 awnihannun 在社交平台發布一首短詩,稱因「未來會 foom」而上調自己的 P(doom),即 AI 導致人類滅絕的主觀機率。詩中還提到中文房間、shoggoth 與死神之眼等 AI 圈內梗,未給出具體數值或論證。