《柳葉刀》主刊研究:Google AMIE 門診輔助,診斷吻合度 90%
Google 與貝斯以色列女執事醫療中心(BIDMC)主導的研究首次登上《柳葉刀》主刊:98 名患者在門診就診前使用 Google 研究級診斷 AI 聊天機器人 AMIE,全程由醫生即時監控,沒有一輪對話因安全問題被中斷。臨床醫生反饋,75% 的場景下 AI 生成的摘要幫他們提前做好接診準備,超過半數案例中 AI 輸出改變了診療思路;AMIE 的鑑別診斷與醫生最終確診吻合度達 90%。研究團隊表示,面向患者端大規模落地仍需更大規模臨床試驗。
Google 成果首次登上《柳葉刀》主刊,給出真實門診中的具體資料:98 例患者、零安全中斷、75% 摘要被醫生認可、診斷吻合度 90%,對關注醫療 AI 落地與安全評估的讀者有參考價值。
原標題:《柳叶刀》研究表明:AI 有望改善医患关系
閱讀原文
| 評分 | 78 / 75(平均 76,門檻 65) |
|---|---|
| 狀態 | 精選 |
相關報導
@GoogleDeepMind: As AI accelerates scientific discovery, we’re helping researchers keep pace by quickly authenticati…
Google DeepMind 發布了一套可快速驗證生物設計是否內建安全防護的工具,並以開放形式供研究使用。該工具面向科研人員,目的是在 AI 加速科學發現的同時不拖慢關鍵研究進度。官方未披露具體工具名稱、技術細節與適用限制。
Google 推出離線會議筆記應用 AI Edge Foresight
Google 發布 Google AI Edge Foresight,一款可在 Mac 上完全離線執行的 AI 會議筆記應用,對標 Granola。它用端側 7.4 億引數的 EmbeddingGemma 2 記錄跨應用及線下會議,採用分屏佈局:一側手寫速記、一側生成 AI 筆記,可檢視轉錄原文,或與 Gemma 4 驅動的助手對話。使用者還能上傳 PDF、Google Docs、Office 文件、純文字、Markdown 與網頁書籤搭建知識庫,會議中即時回答相關問題。
猶他州啟動全美首個 AI 獨立問診開藥試點
猶他州推出全美首個由 AI 獨立完成問診與開藥的試點專案,無需醫生直接監督。患者訂閱 Nolla Health 每月 4.99 美元的應用並掃描面部,AI 結合病史與個人資訊給出痤瘡嚴重度評分,從八種獲批外用藥物中推薦方案。試點為期一年,僅限輕中度痤瘡:前 100 張處方由醫生稽核,隨後 400 張改由 AI 直接提交藥房、醫生每週回溯,最終階段每月抽查至少 10% 的處方。
Our AI Midwife
Astral Codex Ten 發布文章《Our AI Midwife》,記錄在分娩過程中使用 AI 的經歷。該文在 Hacker News 獲得 32 分、5 條評論,討論集中在 AI 在醫療場景中的實際作用與邊界。
Google Cloud 開源 AQuA,為生產環境 agent 做品質診斷
Google Cloud 開源參考實現 AQuA(Ambient Quality Agent),用於持續診斷已在生產環境執行的 AI agent 的品質問題。它與生產 agent 並排執行,掃描失敗聚類並對照對話記錄逐條驗證,再把根因定位到當時實際部署的原始碼快照。它針對的場景是:agent 做到 80% 之後難以繼續改進,且靜默的品質回退仍然返回 HTTP 200 OK。