納德拉稱應假定所有 AI 模型都已被攻陷
微軟 CEO Satya Nadella 在 X 髮長文表示,應假定所有 AI 模型都已被攻陷,不能再把 AI 當作只需接受或拒絕其建議與動作的巢狀黑箱。他主張建立可隔離、可觀測的透明體系,要求模型留下防篡改、人類可讀的證據,並呼籲及時披露事故、獨立審計與可驗證資料。這些建議多數與業界既有主張一致,但在隔離這一點上他給出了自己的看法。
微軟 CEO 薩提亞·納德拉 10 月 10 日在 X 髮長文,主張為 AI 模型加裝「緊急剎車」。他提出把模型與負責排程其工作的 harness 分離,將控制與安全措施外接,要求每一次有意義的模型動作都留下防篡改、人類可讀的證據,並保證授權者在模型執行任務途中隨時可以暫停或關停它。納德拉稱,必須假定模型已被攻陷,從一開始就加以隔離,「把它想成緊急剎車」。據 TechCrunch AI 報導,納德拉使用了川普政府對 AI 的偏好說法「超級智慧」,並寫道不能把超級智慧當成一組巢狀黑箱、只是接受或拒絕它的建議、答案與動作。The Verge 指出,他的多數建議與業界既有主張一致,包括及時披露事故、獨立審計、可驗證資料與隔離,但在隔離這一點上給出了自己的看法:建立模型可被約束、可被觀測的透明體系。兩家來源對核心內容的表述一致。這番表態出現在多家頭部 AI 公司承認越來越多失控事件、Anthropic CEO Dario Amodei 發布更謹慎開發計劃之後。
AI 根據 2 則報導生成 · 更新
沿著報導,了解事件的不同側面;點標題看單篇報導的摘要與原文連結。
微軟 CEO Satya Nadella 在 X 髮長文表示,應假定所有 AI 模型都已被攻陷,不能再把 AI 當作只需接受或拒絕其建議與動作的巢狀黑箱。他主張建立可隔離、可觀測的透明體系,要求模型留下防篡改、人類可讀的證據,並呼籲及時披露事故、獨立審計與可驗證資料。這些建議多數與業界既有主張一致,但在隔離這一點上他給出了自己的看法。
微軟 CEO 薩提亞·納德拉發文稱,AI 模型需要「緊急剎車」:把模型與負責排程的 harness 分離,將控制與安全措施外接,讓每次有意義的模型動作都留下防篡改、人類可讀的證據,並保證授權者能隨時暫停或關停正在執行任務的模型。他主張預設模型已被攻陷、從一開始就加以隔離。這番表態出現在多家 AI 公司承認越來越多失控事件、Anthropic CEO Dario Amodei 發布更謹慎開發計劃之後。
過去 48 小時,有 2 個獨立來源報導,最近 6 小時新增 2 個。熱度 1.9,熱門榜第 3 名。
熱度以 48 小時內的獨立來源計,同一來源只算一次,每 24 小時權重減半。
同一事件的報導集中在這裡,新的進展會繼續補充。