搜尋 關鍵字 語意 依意思最接近的 27 筆
Hugging Face blog10/2 05:01 AI 評分46
ServiceNow CoreAI 發布 AutoSynthData,用目標模型的失敗案例和更強 teacher 的成功案例定位能力缺口,再自動生成並驗證新的訓練任務。每個任務由 system specification、user prompt 和 verifier 三部分組成:任務要可行、真實、對當前模型有難度,verifier 要一致、可靠且完備。流程先用診斷任務評測目標模型,把發現提煉成能力規格卡片並據此生成新任務,模型變強後課程自動轉向它仍做不好的部分。
Hacker News front page10/2 21:39 AI 評分63
技術與人權研究者 Roya Pakzad 發布對比測試,用世界銀行全球公共採購資料庫任務,分別以英文(美國)和波斯語(伊朗)在網頁版 Muse、Claude Cowork Opus 5.5、GPT 6.1 Sol 上執行。權限差異明顯:GPT 只在開頭請求一次網站訪問並提供允許所有相關網站選項,Claude 兩個任務各請求 9 次,Muse 到第四步才請求。
X @GoogleDeepMind10/1 18:11 AI 評分42
Google DeepMind 發布一期播客,討論 AI 生成內容逼真化後如何驗證內容來自人類、機器還是自然,核心手段是來源溯源與不可感知水印。節目時間軸顯示內容涵蓋水印定義、SynthID、影像與影片、SynthID Bio 以及未來韌性,其中 SynthID 部分從 4 分 35 秒開始,SynthID Bio 從 19 分 28 秒開始。
Hugging Face blog● 精選 10/2 16:19 AI 評分65
Ai2 開源了 8B 的科學報告生成模型 AstaBrief,可把研究問題和檢索到的文獻片段直接寫成帶引用的報告。它已在 Asta 的 Generate a report 功能中以 Fast mode 上線,與 Claude 驅動的 Thinking mode 並列:Fast mode 平均 51.1 秒生成一份報告,Thinking mode 為 178.5 秒,快約 3.5 倍。模型基於 Qwen3-8B,用 SFT 加 DPO 訓練,一次成稿,跳過了片段摘要與聚類環節。
Hugging Face blog10/3 23:56 AI 評分55
微軟與 Hugging Face 聯合發布 ThinkingBox,通過 Hugging Face 提供,用 507 個有狀態業務流程、每個任務重複 20 次來評測 agent 留下的後端狀態與副作用,而非只看工具呼叫和最終回覆。在 121,680 次有效試驗中,79,853 次未通過可執行檢查,其中 67.24% 仍乾淨結束並呼叫了改狀態的工具、未報錯。
X @OpenAIDevs10/3 01:17 AI 評分42
OpenAI 開發者帳號發布提醒,讓正在使用 Agents API 建置應用的開發者瞭解最新變化,但正文未披露具體更新內容、發布時間或功能細節。目前只有一句引導語,沒有可操作的資訊。
X @sama10/1 20:18 AI 評分40
OpenAI CEO Sam Altman 在 2026 年 10 月 1 日發帖表示,使用者應當能在任何需要的地方使用自己的 AI 訂閱。該表態未說明具體實現方式、覆蓋產品、時間表或限制條件。
r/ClaudeAI top of the day10/2 22:23 AI 評分32
一位使用者在 Blender 中使用 Claude Opus 5.5 做 blockout 時發現,直接畫出空間意圖比用文字描述形狀更高效,因為文字擅長說明是什麼,卻不擅長表達位置、大小和數量。整個實驗共消耗 33M tokens,API 成本 16.07 美元,執行 48.5 分鐘,貼圖與夜空素材來自 Poly Haven 的 CC0 資源。作者因此不再用文字描述形狀,而是給 Claude 提供繪圖或空間參考。
TechCrunch AI10/2 18:56 AI 評分61
白宮本週把 Zuckerberg、Bezos、Musk 與 Anthropic 的 Dario Amodei 等主要科技公司 CEO 聚到一起,簽署川普稱為具有道德約束力的 AI 安全承諾。川普還簽署行政令,正式把 AI 改稱 super intelligence,Meta 與 OpenAI 則在給自家 AI 產品換上更友好的形象。但原標題指出,只有 2% 的消費者在為 AI 付費。
TechCrunch AI10/3 15:00 AI 評分38
越來越多 AI agent 無需下載 App,直接通過 iMessage、RCS、SMS、WhatsApp 或 Telegram 發訊息即可使用,能記住上下文、連線已有應用並代為完成任務。
Hacker News front page10/3 20:12 AI 評分20
Astral Codex Ten 發布文章《Our AI Midwife》,講述用 AI 充當接生助手的經歷,原文連結已公開。該文在 Hacker News 上獲得 32 分、5 條評論,討論熱度不高。文章具體使用的模型、工具與效果原文未在給定資訊中說明。
X @OpenAIDevs10/2 23:39 AI 評分17
OpenAI 開發者帳號 @OpenAIDevs 在 2026 年 10 月 2 日發布了一條 X 帖子,正文只有一個指向 X 文章(x.com/i/article/2106076978206175232)的連結,沒有附帶任何文字說明。目前公開可見的資訊僅此一條連結,文章的具體內容、涉及的產品或發布時間均未在帖子正文中披露。
OpenAI News10/2 17:15 AI 評分48
OpenAI 發布了一份面向初創公司的 GPT-6 系列模型指南,教團隊如何選擇 GPT-6 模型、調整推理強度、改進提示詞與技能、協調工具,併為生產環境準備 workflows。指南覆蓋從選型到上線的完整流程,目標讀者是用 GPT-6 建置產品的初創團隊。
r/OpenAI top of the day● 精選 10/3 16:36 AI 評分80
OpenAI 發布了 GPT-6 系列的模型指南,內容涵蓋模型選擇、推理強度(reasoning effort)與工具使用。該指南面向使用 GPT-6 系列的開發者,幫助其在具體場景中決定選哪個模型、投入多少推理算力以及如何呼叫工具。原文未披露具體模型型號、引數或發布時間等細節。
TechCrunch AI10/2 18:48 AI 評分57
白宮本週把扎克伯格、貝索斯、馬斯克和 Anthropic 的 Dario Amodei 等主要科技公司 CEO 聚到同一場合,簽署一份 AI 安全承諾,川普稱這份承諾具有道德約束力。川普還簽署行政令,正式把 AI 改稱為超級智慧。與此同時,Meta 和 OpenAI 正讓自己的 AI 產品顯得更親和。原文未披露承諾的具體條款、完整簽署方名單或執行方式。
Hacker News front page10/2 22:25 AI 評分62
Ai2 開源 AstaBrief 8B:一個把研究問題與檢索到的文獻片段轉成帶引用報告的模型,基於 Qwen3-8B 用 SFT 與 DPO 訓練,權重、訓練資料和一份可從自己 PDF 生成報告的範例工作流一併放出。它已作為 Asta 的 Generate a report 功能中的 Fast mode 上線,與 Claude 驅動的 Thinking mode 並存;
X @karpathy10/2 01:37 AI 評分50
Karpathy 認為,隨著 LLM 能力提升,人的工作會更多轉向監督與理解模型輸出,而 LLM 本身也能幫忙。他推薦幾個技巧:讓模型用 ASD-STE100 受控語言寫作,或要求輸出 HTML 網頁、圖表,甚至定製講解影片,例如用 ElevenLabs API key 生成 3b1b 風格影片。這些大型、一次性軟體產物以前不值得做,現在可以按需生成。
Latent Space● 精選 9/30 23:23 AI 評分81
OpenAI 在 DevDay 上發布 GPT-6.1 Sol、個人助理產品 Dots,以及內建 Computer Use 的 Agents API,開發者可基於與 Codex、ChatGPT 相同的 Computer Use 建置應用。Ari Weinstein 稱 GPT-6.1 Sol 成本是 Astra 的五分之一,用在 Computer Use 上只需七分之一。
Hacker News front page10/3 18:03 AI 評分55
2026 年 10 月 3 日一篇文章指出,市面上的記憶外掛都靠 RAG:把對話切成片段存入向量庫,每次提示注入最相似的 5 條,存在相似度不等於正確、片段脫離上下文、舊記錄被當成事實、Agent 不知道自己不知道什麼、儲存不可審計等問題。作者主張改用文件式記憶,讓 Agent 工作前查閱、工作後更新 Markdown 文件,並稱已據此做出外掛 Operator Memory,不用向量資料庫和嵌入。
The Verge AI10/3 16:00 AI 評分21
Splice CEO Kakul Srivastava 認為 AI 生成的郵件正在扼殺對話。她此前在 Flickr、Yahoo、GitHub 和 Adobe 擔任高管,如今領導這家為音樂製作人提供 one-shot 與旋律 loop 的取樣平台,其取樣曾被 Lisa 的《Money》和 Sabrina Carpenter 的《Espresso》等熱門歌曲使用。她還主導收購了 Spitfire Audio,並推動平台向更多領域拓展。
X @OpenAIDevs● 精選 10/2 23:40 AI 評分76
OpenAI 開發者帳號發布 dot,它能學習使用者的工作方式、跨應用保留上下文、協調 Codex 任務,並標記需要使用者關注的事項。目前官方只給出這四項能力描述,未公布定價、可用平台與上線時間。
r/ClaudeAI top of the day10/3 18:49 AI 評分56
Opus 5.5 幾乎完全自主地製作了一支兩分鐘的“四年 AI 回顧”影片。作者只提供了創意、工作資料夾和音樂檔案,模型自行檢索四年 AI 資料、尋找素材與截圖、編寫 HTML 與動畫程式碼、用 Playwright 渲染場景、用 FFmpeg 合成並加入音效,最終輸出成片。
X @OpenAIDevs10/1 23:11 AI 評分21
OpenAI 開發者帳號宣布,把 ModRetro Chromatic 掌機加入 ChatGPT 的 side quest,參與視窗還剩 48 小時。活動入口為 side-quests.openai.chatgpt.site,原文未說明具體獎勵形式、參與條件與地區限制。
r/OpenAI top of the day10/3 13:09 AI 評分15
一位 Reddit 使用者收到了 OpenAI gpt tv 網站彩蛋活動中申領的 Astra CD。該彩蛋幾週前上線,使用者當時可線上申領這張 CD,發帖者表示原本沒指望真能收到,並稱稍後會公布 CD 裡的內容。
NVIDIA blog● 精選 10/2 00:44 AI 評分86
GPT-6 Astra Ultrafast 已上線,執行在 NVIDIA Blackwell GPU 上,面向 OpenAI 內部以及符合條件的 ChatGPT Work 和 Codex 使用者開放,token 生成速度最高可達 Astra Standard 模式的 8 倍。開發者今天就能通過 API 呼叫,接入方式、定價與實現細節見官方 Ultrafast 指南。更快的生成可縮短 coding agent 的編輯—測試—除錯迴圈,減少工具呼叫之間的等待時間。
X @awnihannun10/2 16:10 AI 評分5
Apple 研究員 awnihannun 在 2026 年 10 月 2 日發帖稱自己上調了 P(doom),即對 AI 帶來災難性後果的主觀機率估計,理由是“未來會 foom”,即智慧爆炸式增長。帖子以四行押韻短詩寫成,還提到中文房間、shoggoth 與死神之眼等 AI 圈梗,但沒有給出具體數字、時間表或技術依據。
r/ClaudeAI top of the day10/3 20:08 AI 評分23
創作者 Marcello Costa 發布 AI 動畫短片 Monkey Business,全流程幾乎都在 Claude 內完成,約 50 天從開工到成片。他用自建的 Seedance 2.5 skill 把自然語言提示轉成詳細視覺提示,再交給 Magnific 裡的 Seedance 2.5 生成畫面,首條提示寫入了整套專案規則,之後靠術語呼叫即可銜接,但仍需大量迭代和後期製作才達到專業水準。