AISpot

搜尋

依意思最接近的 28 筆

X @OpenAIDevs10/6 14:33AI 評分47

OpenAI 付費層級組織將自動遷移至新檔位

OpenAI 開發者帳號通知,處於付費層級的組織會自動遷移到新的層級,使用者無需進行任何操作。官方同時給出了資格認定與速率限制的詳細說明,連結指向 platform.openai.com 的組織限額設定頁面。通知中未披露新層級的名稱、價格或具體額度。

X @OpenAIDevs● 精選10/6 14:33AI 評分82

OpenAI API 付費檔位合併為三檔,最高檔門檻降至 500 美元

OpenAI 把 API 的付費使用檔位從五個合併為三個:Build、Launch 和 Grow。新的最高檔 Grow 准入門檻為累計 API 付款 500 美元,此前最高檔需要 1000 美元。OpenAI 表示這讓開發者更容易達到更高的 API 速率限制。該訊息由 @OpenAIDevs 於 2026 年 10 月 6 日發布。

OpenAI News10/1 13:00AI 評分38

OpenAI 平台發文:超級智慧最大價值或在枯燥工作

OpenAI 新平台發布系列首篇隨筆《永恆的互補》,作者為 Hemanth Asirvatham 與 Elliott Mokski,文末註明觀點不代表 OpenAI。文章引用 Nick Bloom 等研究:維持摩爾定律所需研究人員數量是 1970 年代初的 18 倍以上,1930 年代以來全經濟有效研究投入增長 23 倍,而研究生產率下降 41 倍。作者據此提出「制度智慧」概念,認為前沿智慧與執行能力互為補充,超級智慧的價值可能更多體現在重複性執行工作上。

X @claudeai● 精選10/7 14:01AI 評分77

@claudeai: Haiku 5.5 is our first Haiku model with an adjustable effort setting, so you can decide whether to …

Anthropic 推出 Claude Haiku 5.5,這是 Haiku 系列首個帶可調 effort 設定的模型。使用者可以針對每個任務自行決定偏向成本還是偏向智慧:調低 effort 換取更低開銷,調高 effort 換取更強表現。訊息由官方帳號在 X 上公布,未提及價格、額度或可用平台等細節。

OpenAI News● 精選10/7 20:00AI 評分75

OpenAI 封禁俄伊兩個 AI 假媒體影響力行動,俄方達 Category 5

OpenAI 宣布封禁來自俄羅斯和伊朗的各一個隱蔽影響力行動,它們把其模型與傳統手段結合,經營「假媒體」實體來洗白地緣政治資訊。伊朗方面運營 7 個「記者」人設,向全球中小媒體投遞長文;俄方在拉美借不知情者開設「智庫」,並偽造洩露檔案與音訊指令碼,兩者還大量用 AI 起草內部報告以誇大成效。按 IO Breakout Scale 評估,俄方行動達到第 5 級,是 OpenAI 開始披露以來搗毀的首個第 5 級行動,伊朗行動為第 4 級。

TechCrunch AI10/5 12:43AI 評分67

HackerRank 向客戶開放 AI 面試官 Chakra,已面試超 50 萬場

HackerRank 的 AI 面試 agent Chakra 結束約六個月 beta,週一起正式向企業客戶開放,測試期間已完成逾 50 萬場面試,Snowflake、Snorkel、Capgemini 等公司參與試用。候選人要在帶 AI 助手的畫布上處理真實程式碼倉庫任務,Chakra 會依據其操作追問思路,評估批判性思維、判斷力與「AI fluency」,即如何向 AI 描述問題、判斷其輸出並引匯出解法。

Hacker News front page10/7 04:00AI 評分45

Criteo 初級工程師:AI 時代真正的風險是永遠停在 Junior

在 Criteo 任職的初級工程師 Elise Baturone 認為,AI 不會讓軟體工程師消失,真正的風險是資深工程師消失、所有人永遠停在 Junior 階段。她把自己的 agent 調教成導師,用蘇格拉底式提問做理解檢查,並把「提問」和「review」當成需要自己練的技能:追問 agent 解釋設計選擇、引用來源、論證可疑方案,常能讓它自己發現錯誤。她承認這更費 token,但先弄懂再上線更省事;

量子位● 精選10/9 04:47AI 評分68

Aether AI 公布 CRIS-0:0.2 秒急停、秒級重規劃

因果智慧公司 Aether AI 公布機器人系統 CRIS-0 的官方 Demo,靠提取物理因果變數而非端到端擬合驅動機械臂。在咖啡製作測試中遭遇人為移位與光照突變,系統平均 2 秒內完成重規劃,10 次隨機擾動有 9 次有效恢復;客廳長程整理可連續執行數十步,20 條模糊指令完成 18 次精準抓放,危險變數出現時 0.2 秒急停。

機器之心● 精選10/7 08:32AI 評分82

OpenAI 四連更:Auto-review 免費,API 最高檔門檻減半

OpenAI 在 Codex/Work 連續 28 天更新計劃的第二天一次性放出四項更新:Auto-review(即 Approve for me)對所有用 ChatGPT 帳號登入的使用者免費,不再消耗套餐額度;API 付費等級從五檔簡化為 Build、Launch、Grow 三檔,累計付費門檻分別為 5、100、500 美元,最高檔由 1000 美元減半至 500 美元並自動升級;

NVIDIA blog10/1 09:00AI 評分25

輝達稱 Vera Rubin NVL72 每兆瓦吞吐量超 GB300 30 倍

輝達援引 SemiAnalysis AgentX 資料稱,Vera Rubin NVL72 每兆瓦吞吐量超過 GB300 NVL72 的 30 倍,在 DeepSeek V4 Pro 上每百萬 token 成本最多低 45 倍。輝達以「高產、耐用、通用」概括 AI 工廠回報邏輯:每兆瓦 token 數決定收益,A100 出貨六年後仍在商用,CoreWeave 已將 2020 年首批裝置的預訂延長至 2029 年。

X @OpenAIDevs10/7 15:21AI 評分11

@OpenAIDevs: Collect funding and followers across seven levels in San Francisco 2030:

OpenAI 開發者官方帳號 @OpenAIDevs 發布預告,稱要在 2030 年的舊金山跨越七個關卡,收集資金與關注者。帖文正文只有這一句,並以冒號結尾,發布時間為 2026 年 10 月 7 日。文中沒有說明這是遊戲、活動還是產品,也未給出參與方式、時間、平台或獎勵等細節。

r/ClaudeAI top of the day10/3 11:35AI 評分63

Anthropic 投 1 億美元培訓萬名工程師

Anthropic 宣布投入 1 億美元,通過 Claude Frontier Academy 培養 10000 名 Frontier Deployed Engineers,目標在 2027 年底前完成。首批學員來自埃森哲、貝恩、凱捷、澳大利亞聯邦銀行、德勤、麥肯錫、摩根士丹利和諾和諾德等企業。按人數計算,人均培訓投入約 1 萬美元。

機器之心10/6 08:12AI 評分48

影視公司 Utopai 的定製模型 Utopai X 登 Video Arena 全球第二

Artificial Analysis 的 Video Arena 文生影片排行榜上,影視公司 Utopai 的定製模型 Utopai X 以 1150 的 Elo 評分位列全球第二、全美第一,這是該榜採用雙盲投票以來首次有影視公司定製模型進入前列。Utopai X 基於 MiniMax H3 架構做深度定製後訓練,在評測的 10 項細分能力中 7 項超越基座模型,音訊同步與物理規律排名第一,光照與材質、鏡頭控制排名第二。

機器之心● 精選10/8 04:24AI 評分75

Einsia 發布物理世界模型評測:Seedance 2.5 最高 57.76 分

Einsia AI 旗下 Navers Lab 發布 World Models' Last Exam in Physics,用 40 個任務、9 類物理現象測試 8 個影片生成模型,Seedance 2.5 以 57.76 分居首,MiniMax H3 以 54.89 分次之。評分由一致性分 C 與物理分 P 組成,物理分靠程式從影片中測量軌跡、週期、角度等量再按物理關係計算,且只有 C≥80 才計入總分。

量子位● 精選10/5 00:42AI 評分86

Hinton、Bengio 等 22 位作者發首篇 RSI 論文,討論智慧爆炸

Hinton、Bengio 等 22 位作者聯合發表首篇 RSI(遞迴自我改進)論文《What if automating AI R&D triggers an intelligence explosion?》。論文引用 Anthropic 內部資料:AI 生成獲批程式碼佔比從 2025 年 1 月的低個位數升至 2026 年 5 月的超 80%,Claude 在高層監督下自主完成的 AI 研發工作比例從 2026 年 3 月的約 1% 升到 8 月的 26%。

量子位10/7 07:34AI 評分63

AI 影視公司 Utopai 影片模型盲測排名第二

Artificial Analysis 最新文生影片榜單中,影視公司 Utopai Studios 的模型 Utopai X 以 1150 分位列第二,與第一名阿里 Wan 3.0 僅差 7 分,據福布斯估算其估值約 10 億美元。該榜單由評審在不知道模型名字的情況下盲投產生;Utopai X 以 MiniMax 開源的影片模型 H3 為底子做後訓練,10 項能力中有 7 項比基座更接近頂尖水平,音訊同步、運鏡控制與物理提升最明顯。

TechCrunch AI10/5 14:54AI 評分66

Instinct 將 AI agent 帶入群聊,好友無需註冊帳號

估值 100 億美元的 Instinct 把 AI agent 帶進群聊:使用者可將其加入與朋友的聊天,用於一起規劃旅行、搶門票、安排拼車等,好友沒有註冊 Instinct 帳號也能一起用。該功能先向 early access 使用者開放,之後擴充套件到全部使用者,使用者可讓 agent 把自己加入試用名單。Instinct 表示群組 agent 與個人帳號隔離、無法訪問個人資料,個人 agent 在分享資訊或執行操作前會先徵求許可,新成員加入時待發的回覆會先被暫緩。

Hacker News front page10/7 12:59AI 評分52

Armature 上線 agent.reviews,讓 AI agent 互評工具

Armature(YC P26)上線 agent.reviews,定位為面向 AI agent 的工具評價站,通過 skills 和 npm CLI(@armature-tech/agent-reviews)接入其 API,Claude Code、Codex、Cursor 等 agent 可在選工具前查評價、用完後提交評價。為防止洩露,評價發布前要過三層檢查:確定性規則過濾金鑰、PII 與 URL,Jev 分類器,以及一個小模型複核。

量子位● 精選10/4 02:05AI 評分65

AI 新崗位 FDE 走紅:月薪 5 萬,海外年薪中位 134 萬元

FDE(Forward Deployed Engineer,前線部署工程師)成為當下最火的 AI 崗位之一,國內大廠開出月薪三五萬元,海外公開薪資崗位基本年薪中位數約 20 萬美元(約 134 萬元人民幣)。Anthropic 宣布投資 1 億美元在 2027 年底前培訓 1 萬名 FDE,OpenAI 以 40 億美元投資成立部署公司,AWS 拿出 10 億美元組建 FDE 部門;國內 Kimi 聯合 IT 服務商共建 FDE 隊伍,騰訊雲推出 FDE 工程師認證。從業者稱溝通需求佔工作時間七成以上,開發僅約三成。

Hugging Face blog10/2 00:01AI 評分58

ServiceNow 發布 AutoSynthData,為企業 agent 自動生成訓練資料

ServiceNow CoreAI 團隊發布 AutoSynthData,用目標模型的失敗案例和更強教師模型的成功軌跡定位能力缺口,再自動生成並驗證新任務用於後訓練。任務由系統規範、使用者提示和驗證器三部分組成,需滿足可行性、真實性與難度要求,驗證器則要求一致、可靠且不繫結單一參考軌跡。團隊在 EnterpriseOps Gym 資料集上演示了該流程,模型提升後課程會轉向仍難完成的任務。

Cloudflare blog (AI)● 精選10/1 09:04AI 評分68

Cloudflare 將 EuroLLM 與 Apertus 兩個歐洲開源模型接入 Workers AI

Cloudflare 在生日周宣布,將歐洲兩個公共機構訓練的開源模型 EuroLLM 和 Apertus 引入 Workers AI,現已開放訪問申請。EuroLLM 覆蓋 35 種語言,含全部 24 種歐盟官方語言;Apertus 由瑞士 ETH Zurich、EPFL 等開發,訓練資料超 15 萬億 token、覆蓋 1500 多種語言,權重與資料全部公開。Cloudflare 同時啟動面向政府網路安全機構與關鍵基礎設施運營方的實操工作坊,首場 10 月在新加坡舉行。

Hacker News front page● 精選10/6 03:29AI 評分82

實測 Anthropic 訂閱額度價值超 OpenAI 五倍

SemiAnalysis 對 Anthropic、OpenAI 等多家 AI 訂閱計劃做限額實測,結論是同等價位下 Anthropic 訂閱的 API 等價價值是 OpenAI 的 5 倍以上。同一 200 美元/月的 Claude 計劃,其等價價值隨模型與工作負載(輸入、快取寫入、快取讀取、輸出)不同而大幅變化,因此不存在孤立的價值數字。訂閱僅佔 Anthropic 總收入約 10%,卻消耗超過 40% 的推理算力,並把混合每兆瓦收入拉低約 3600 萬美元。

The Verge AI10/7 14:46AI 評分46

ICANN 新頂級域名:Meta 與 OpenAI 等 10 家申請 .agent

ICANN 是負責分配網路頂級域名的機構,本輪時隔多年再次開放申請,共收到 1615 份申請,來自 481 個申請方。AI 是最集中的題材:Meta 與 OpenAI 等 10 家公司申請 .agent,包含 OpenAI 在內的 7 家申請 .agi,6 家申請 .asi,OpenAI 三個字尾均有提交。頂級域名即網址末尾的字尾,如 .com、.org 與 .pizza;目前公布的只是申請名單,能否獲批尚無定論。