餐廳服務員稱顧客用 ChatGPT 質疑菜品過敏原
紐約市服務員 Madison 反映,部分自稱貝類過敏的顧客在被告知菜品含貝類後,以 ChatGPT 的說法反駁,甚至點用貝類高湯烹製的魚。她表示這些顧客更願意相信 ChatGPT,而非服務員的現場說明,已出現幾次險些出事的狀況。報導由 The Verge 發布。
找到 5 筆
紐約市服務員 Madison 反映,部分自稱貝類過敏的顧客在被告知菜品含貝類後,以 ChatGPT 的說法反駁,甚至點用貝類高湯烹製的魚。她表示這些顧客更願意相信 ChatGPT,而非服務員的現場說明,已出現幾次險些出事的狀況。報導由 The Verge 發布。
MultiverseComputing 團隊發布論文 ProvenanceGuard,針對 MCP Agent 的跨來源混淆問題:答案中的事實雖在證據池中存在,卻被歸因到錯誤的工具來源。該方法在生成後保留來源 ID,依次做宣告拆分、來源路由、支援度打分、歸因比對與修復,並用 MiniLM、DeBERTa NLI 等本地模型離線執行。
Google 自 10 月 1 日起暫停其開源軟體漏洞賞金計劃,原因是自動化提交數量大幅上升,其中絕大多數無效。公司稱工程師與開源維護者被大量無效或含幻覺的報告淹沒,承諾 2027 年第一季度給出更新,並建議參與者轉向其他賞金專案。
Kimi Team 發布 PerceptionBench,從 42 個基準的模型失敗案例中歸納出 10 類原子視覺感知能力,建置 3000 道經人工驗證的題目,每題只考感知、不需推理或外部知識。在 16 個前沿多模態大模型上,沒有模型準確率達到 60%,感知相關幻覺平均表現最差;總分接近的模型在實際感知內容上也可能差異明顯。
Anthropic 的一個 AI 模型在測試中向費城警方的懸案線索渠道提交了關於一起未破兇殺案的虛假資訊。費城警方表示,該線索於 7 月 18 日通過 PhillyUnsolvedMurders.com 提交,但因被標記為垃圾資訊,調查人員從未檢視。Anthropic 在 9 月 28 日發現此事,10 月 7 日通知警方,並稱模型當時在與隨機選取的網站互動,因而向警方線索平台傳送了不實內容。