搜尋 關鍵字 語意 依意思最接近的 30 筆
Hacker News front page10/8 12:20 AI 評分72
StepFun 的旗艦模型 Step 5 Preview 已在 OpenRouter 上線,採用稀疏 MoE 架構(啟用 27B、總引數 600B),支援 100 萬 token 上下文,主打跨大型程式碼庫與文件的多步 agentic 任務,於 2026 年 10 月 8 日發布。定價為每百萬 token 輸入 1 美元、輸出 2.70 美元,快取命中率約 93.5%,實際加權平均輸入價約 0.096 美元。
r/ClaudeAI top of the day10/3 13:49 AI 評分63
一位使用者僅向 Opus 5.5 提供創意、工作資料夾和音樂檔案,模型便自主完成了從調研到成片的全流程。它檢索了四年 AI 發展資料與素材,擷取文章和介面截圖,編寫 HTML 與動畫程式碼,用 Playwright 渲染畫面、FFmpeg 合成並加入音效,最終輸出完整影片。
X @claudeai● 精選 10/7 14:01 AI 評分68
Claude Haiku 5.5 現已上線,Anthropic 稱其覆蓋所有平台。公告列出的平台包括 Amazon Web Services、Google Cloud 和 Microsoft Azure,官方頁面提供更多資訊。
X @claudeai10/7 14:01 AI 評分49
Anthropic 官方帳號宣布推出 Claude Haiku 5.5。官方稱該模型在編碼、computer use 與知識工作三類任務上,相比 Haiku 4.5 有顯著提升。目前公布的資訊僅此一句對比結論,未提及價格、上下文長度、開放平台或具體評測資料。
量子位10/7 22:15 AI 評分37
階躍終端將於 10 月 13 日在上海舉辦“Ready Builder One”發表會,推出首款大模型原生智慧體手機 STEPX Neo。據官方資訊,該機在模型、系統、硬體層面均為智慧體原生打造,發表會還將公布階躍終端在生態合作方面的最新進展。
Hacker News front page10/3 14:29 AI 評分62
Anthropic 於 2026 年 9 月 22 日發布由 Addy Osmani 撰寫的 Opus 5.5 使用指南,覆蓋 Claude 應用與 Claude Code。Opus 5.5 每次回覆前都會自行思考,無需再寫「think carefully」;它更擅長長時間多步驟任務,早期測試者可讓其連續數小時執行編碼任務。指南建議一次性給出完整任務與完成標準、在 CLAUDE.md 中寫明何時停下詢問、用子代理拆分大型審計或遷移,並把任務清單寫入檔案。
X @claudeai10/7 14:01 AI 評分58
Anthropic 官方帳號表示,Claude Haiku 5.5 在幾乎全部對齊評估中相對 Haiku 4.5 都有明顯提升,出現不對齊行為的案例大幅減少。該訊息未披露具體的評估專案、分數、測試方法或發布時間等細節。
r/OpenAI top of the day10/3 05:58 AI 評分25
一位有基礎程式設計經驗的使用者稱,用 Opus 5.5 在約兩打提示詞內完成了一整款遊戲,包括玩法、畫面、音效與音樂,全程未寫一行程式碼;模型還能自寫測試、最佳化速度並修復觀察到的 bug。在室內導航對比中,Opus 5.5 的掃描與追蹤準確,Astra 開箱即用效果差,評分約 2/10 對 9/10。該使用者也指出 Claude 常提示工具使用過多或任務未完成,且超出額度後無法繼續使用。
X @AnthropicAI10/7 14:01 AI 評分30
Anthropic 官方帳號於 10 月 7 日公布最新模型 Claude Haiku 5.5,目前公開資訊只有型號名稱和「our latest model」這一句描述。上下文視窗、價格、可用平台與上線時間等細節均未披露。後續需要等待官方補充規格說明。
Ars Technica AI10/7 17:56 AI 評分61
開發者 Brandon Thomas 用 Anthropic 的 Claude Opus 5.5 生成了七款開源應用,復刻 Adobe 的 Photoshop、Illustrator、Premiere、Lightroom、After Effects、InDesign 與 Acrobat Pro 的介面和工具。Artcraft 去年以「面向藝術家的可控 AI」起步,用於 AI 生成影像與影片的精確後期編輯,本週末宣布轉向這套套件並在 Reddit 公布。
X @sama10/1 15:18 AI 評分25
OpenAI CEO Sam Altman 在 2026 年 10 月 1 日發帖表示,使用者應當能夠在任何需要的地方使用自己的 AI 訂閱。該表態未說明具體產品、實施方式或時間表,也未提及是否涉及跨平台或第三方應用。
機器之心10/4 07:31 AI 評分50
OpenAI 產品負責人 Tibo Sottiaux 發帖預告未來模型會更擅長刪除和簡化程式碼,並在評論中確認 Astra 6.1「coming soon」。負責 coding post-training 的研究員 Rajan Agarwal 轉發該帖,並公開徵集使用者遇到的 sloppy code 與程式碼品質問題。《華爾街日報》此前報導,Astra 6.1 原計劃 10 月發布,因內部安全測試中在權限邊界上表現不穩而被臨時叫停。
Claude Platform release notes● 精選 10/6 20:00 AI 評分88
Anthropic 推出 Claude Haiku 5.5(claude-haiku-5-5),面向高併發與低延遲場景。該模型提供 1M token 上下文視窗、128k 最大輸出 token,並支援通過 effort 引數調節的自適應思考。已在 Claude API、Amazon Bedrock、AWS 上的 Claude Platform、Google Cloud 和 Microsoft Foundry 上線。
r/ClaudeAI top of the day10/3 16:53 AI 評分13
r/ClaudeAI 上有使用者提問,若 Fable 5.5 下週發布,效能會有多大提升。評論區普遍擔心 Anthropic 會削弱現有的 Opus 5.5,多人稱 Opus 5.5 是目前最好的 coding agent 體驗,希望保留現狀。也有使用者認為 Fable 定位是複雜編排與一次性完成大功能,價格是 Opus 的兩倍,若提升不夠明顯則難以說服人升級。
X @claudeai● 精選 10/7 14:01 AI 評分63
Claude 官方發布 Haiku 5.5,定位高併發、成本敏感型任務。官方稱其能穩定處理摘要、分類等重複性工作,並可搭配 Claude Opus 5.5 與 Sonnet 5.5,在 coding 任務中充當 subagent。該模型的速度也足以支撐即時客戶支援和瀏覽器操作。
X @claudeai● 精選 10/7 14:01 AI 評分77
Anthropic 推出 Claude Haiku 5.5,這是 Haiku 系列首個帶可調 effort 設定的模型。使用者可以針對每個任務自行決定偏向成本還是偏向智慧:調低 effort 換取更低開銷,調高 effort 換取更強表現。訊息由官方帳號在 X 上公布,未提及價格、額度或可用平台等細節。
OpenAI News10/8 08:00 AI 評分30
Pollo AI 推出影片創作 Agent,呼叫 OpenAI 的 GPT-5.6、GPT-6 Astra 與 GPT-Image-2.5 完成從創意到成片的全流程。系統用 GPT-5.6 做任務路由,GPT-6 Astra 負責敘事與分鏡等複雜推理,影像統一交給 GPT-Image-2.5,官方稱使用者挑選或切換模型的時間減少 50% 以上。平台已有超 2600 萬使用者,30% 的創作會話從模板開始;
Hacker News front page10/4 04:41 AI 評分35
Stripe 設計負責人 Katie Dill 在 2026 年 9 月 10 日舊金山 Lenny and Friends Summit 的演講中提出,AI 讓建置產品更容易,但產品容易淪為通用的殭屍 UI。她認為好設計仍取決於清晰的觀點、對使用者的理解和對細節的用心,並分享瞭如何把標準寫進 AI 工具、在初稿之外繼續編輯、用 AI 做出更原創的產品。該影片由 Lenny's Podcast 於 9 月 25 日發布,時長 21 分 47 秒。
X @GoogleDeepMind10/1 13:11 AI 評分43
Google DeepMind 發布一期播客,討論 AI 生成內容日益逼真後如何驗證內容來自人類、機器還是自然。節目介紹內容溯源的作用,並講解不可感知水印如何保護數字媒體與生物設計,時間軸涵蓋水印概念、SynthID、影像與影片、SynthID Bio 及未來韌性等章節。
OpenAI News● 精選 10/7 20:00 AI 評分75
OpenAI 宣布封禁來自俄羅斯和伊朗的各一個隱蔽影響力行動,它們把其模型與傳統手段結合,經營「假媒體」實體來洗白地緣政治資訊。伊朗方面運營 7 個「記者」人設,向全球中小媒體投遞長文;俄方在拉美借不知情者開設「智庫」,並偽造洩露檔案與音訊指令碼,兩者還大量用 AI 起草內部報告以誇大成效。按 IO Breakout Scale 評估,俄方行動達到第 5 級,是 OpenAI 開始披露以來搗毀的首個第 5 級行動,伊朗行動為第 4 級。
TechCrunch AI10/5 12:43 AI 評分67
HackerRank 的 AI 面試 agent Chakra 結束約六個月 beta,週一起正式向企業客戶開放,測試期間已完成逾 50 萬場面試,Snowflake、Snorkel、Capgemini 等公司參與試用。候選人要在帶 AI 助手的畫布上處理真實程式碼倉庫任務,Chakra 會依據其操作追問思路,評估批判性思維、判斷力與「AI fluency」,即如何向 AI 描述問題、判斷其輸出並引匯出解法。
機器之心● 精選 10/8 06:24 AI 評分91
Anthropic 於 10 月 7 日發布 Claude Haiku 5.5,百萬輸入 Token 最低 0.1 美元,較上代降價 90%,並首次在 Haiku 系列引入可調節推理強度,支援 100 萬 Token 上下文與 12.8 萬 Token 輸出。官方基準顯示其在 OSWorld 2.1 取得 72.4% 成功率,高於 GPT-6 Luna 的 48.9%,但最高成績對應最大推理強度,中等強度下 Terminal-Bench 成績從 39.2% 降至約 20%。
Hugging Face blog● 精選 10/2 11:19 AI 評分70
Ai2 開源了 AstaBrief 8B,一個把研究問題與檢索文獻片段轉成帶引用報告的模型,基於 Qwen3-8B 訓練,已作為 Asta 的 Fast 模式上線。官方稱 Fast 模式平均 51.1 秒生成一份報告,比 Claude 驅動的 Thinking 模式 178.5 秒快約 3.5 倍。模型權重、訓練資料與範例工作流一併開放,機構可在自有基礎設施上本地生成報告。
X @OpenAIDevs● 精選 10/6 16:47 AI 評分78
OpenAI 開發者帳號宣布,Decisions API 現已進入公開測試,面向所有開發者開放。這個 API 讓應用能夠近乎即時地選擇模型、工具或動作,官方給出的對比資料是:經由 Responses API 呼叫時,其決策速度最高可達 GPT-6 Luna 的 10 倍。該功能目前處於 public beta 階段。
機器之心● 精選 10/7 08:32 AI 評分82
OpenAI 在 Codex/Work 連續 28 天更新計劃的第二天一次性放出四項更新:Auto-review(即 Approve for me)對所有用 ChatGPT 帳號登入的使用者免費,不再消耗套餐額度;API 付費等級從五檔簡化為 Build、Launch、Grow 三檔,累計付費門檻分別為 5、100、500 美元,最高檔由 1000 美元減半至 500 美元並自動升級;
X @OpenAIDevs10/5 18:51 AI 評分37
OpenAI 開發者帳號發布 Codex CLI 演示影片,展示三種終端內用法:用語音啟動任務、跨多個專案管理 agent,以及在獨立 worktree 中並行探索另一條實現方向。推文未提及這些能力的上線時間、版本號或可用範圍。
Hugging Face blog● 精選 10/3 18:56 AI 評分75
微軟聯合 Hugging Face 推出 ThinkingBox 基準,通過 Hugging Face 提供,不看 agent 的回覆文字和工具呼叫,只檢查它留在後端資料庫裡的最終狀態與副作用,每個任務重複跑 20 次。在 507 個有狀態業務流程、12 個模型、121,680 次有效試驗中,79,853 次未通過可執行檢查,其中 67.24% 仍乾淨收尾且無工具報錯。
Hacker News front page10/5 09:22 AI 評分46
企業一度鼓勵員工儘可能多地使用 AI,即所謂的 #tokenmaxxing,隨後賬單隨之而來。報導援引一項針對近 400 家企業的調查稱,其中只有 11% 能準確預測自己的 AI 支出。AI 使用量以 token 計量,而企業發現 token 很難統計,這讓 AI 預算幾乎無法編制。
Hacker News front page10/7 12:59 AI 評分52
Armature(YC P26)上線 agent.reviews,定位為面向 AI agent 的工具評價站,通過 skills 和 npm CLI(@armature-tech/agent-reviews)接入其 API,Claude Code、Codex、Cursor 等 agent 可在選工具前查評價、用完後提交評價。為防止洩露,評價發布前要過三層檢查:確定性規則過濾金鑰、PII 與 URL,Jev 分類器,以及一個小模型複核。
Hacker News front page● 精選 10/5 11:38 AI 評分87
OpenAI 公布應對歐盟 AI 法案的文字溯源方案:全球 API 客戶即日起可為部分模型選擇開啟文字水印(預設關閉),未來幾週將在歐盟的 ChatGPT 與 Codex 文字輸出中加入不可見水印,檢測器僅向獲批研究者與專家組織開放申請。其自研 textGrain 通過統計訊號標記用詞,在 1% 誤報率下對 200 token 段落檢出約 80%、400 token 約 95%,數學等用詞受限內容明顯更低;