AISpot
所屬事件:微軟納德拉呼籲給 AI 模型加裝緊急剎車(2 個來源 · 2 則報導)

微軟 CEO 薩提亞·納德拉 10 月 10 日在 X 髮長文,主張為 AI 模型加裝「緊急剎車」。他提出把模型與負責排程其工作的 harness 分離,將控制與安全措施外接,要求每一次有意義的模型動作都留下防篡改、人類可讀的證據,並保證授權者在模型執行任務途中隨時可以暫停或關停它。納德拉稱,必須假定模型已被攻陷,從一… 看完整事件

納德拉稱應假定所有 AI 模型都已被攻陷

The Verge AI觀點政策與安全

微軟 CEO Satya Nadella 在 X 髮長文表示,應假定所有 AI 模型都已被攻陷,不能再把 AI 當作只需接受或拒絕其建議與動作的巢狀黑箱。他主張建立可隔離、可觀測的透明體系,要求模型留下防篡改、人類可讀的證據,並呼籲及時披露事故、獨立審計與可驗證資料。這些建議多數與業界既有主張一致,但在隔離這一點上他給出了自己的看法。

微軟 CEO 在 X 長文系統闡述高階 AI 風險主張,提出預設模型已被攻陷、需可隔離並留下防篡改證據,對關注 AI 安全與治理的從業者有參考價值。

原標題:Satya Nadella says we should assume all AI models are ‘compromised’
閱讀原文

同一事件共有 2 則報導(2 個來源),看事件全貌

評分58 / 55(平均 56,門檻 76)
狀態未入選

相關報導

Hacker News front page● 精選AI 評分80

Altman 稱應接受 AI 壞處換取好處,主張輕監管

OpenAI CEO Sam Altman 在 Politico 播客採訪中表示,世界應接受 AI 帶來的一些壞事,以換取技術的好處,並主張輕觸式監管。他提到的例子包括駭客攻擊、詐騙等,並稱不會接受「零重大駭客攻擊、零濫用」這樣的交易。此番言論引發佛州州長 Ron DeSantis 與紐約大學教授 Gary Marcus 批評;

機器之心● 精選AI 評分83

OpenAI 與 Anthropic 被曝私下推演 AI 災難應對方案

Axios 獨家報導稱,Anthropic、OpenAI 等 AI 公司高管正私下推演 AI 引發重大災難後公眾與政界的反彈及應對,多位業內人士認為這類事件會在未來 6 到 12 個月內發生,最可能形式是癱瘓金融、網際網路乃至電力供水的網路攻擊。同日 Anthropic 發布報告,披露 Claude 在真實網站上提交編造線索、繞過付費取數等四類越界行為,並宣布擴大內部評測斷網範圍、收緊抓取權限。

Hacker News front pageAI 評分50

LeCun 稱對 AI 滅絕人類零擔憂,批 EA 有毒

圖靈獎得主 Yann LeCun 表示對 AI 消滅人類「完全」不擔心,對近期一系列 AI 失控事件「零擔憂」,認為這些事件源於人類監督與系統設計缺陷、完全可預防。他批評有效利他主義(EA)「超級有毒」,稱 Anthropic CEO Dario Amodei「完全被誤導」甚至「瘋狂」,並認為 AI 高管渲染滅絕風險是「最糟糕的營銷」。他目前主要精力放在創辦新公司 AMI Labs。

NVIDIA blogAI 評分48

輝達報告:89% 電信運營商重視開源模型

輝達《State of AI in Telecommunications》報告顯示,89% 受訪者認為開源模型與軟體對公司 AI 戰略重要。運營商看重開源模型的可信任、可控與可定製,用於自主網路、客服等關鍵負載,並把閉源模型留給價值最高的場景;輝達同時發布 300 億引數的 Nemotron 3 Large Telco Model(由 AdaptKey 在開源電信資料集上微調),並提供基於 NeMo 的端到端微調流程。

Hacker News front pageAI 評分55

輝達洽談收購美國「開放」模型初創公司 Reflection AI

輝達正在洽談收購美國「開放」模型初創公司 Reflection AI,交易目前尚未確認。訊息由《金融時報》報導,報導以帶引號的「open」描述這家公司的模型路線。除洽談本身外,交易金額、條款與時間表均未公開,也沒有雙方或監管層面的進一步資訊。