AI search

Google AI Overviews 醫療建議出錯:英國慈善團體提出警告

2026 年 1 月 2 日衛報調查發現,Google AI Overviews 在健康查詢上給出錯誤建議:胰臟癌飲食、肝指數正常範圍、抹片診斷角色都出錯。英國醫療慈善團體警告民眾暴露於風險,Google 回應稱絕大多數摘要準確。

Google AI Overviews 醫療建議出錯:英國慈善團體提出警告 — 文章封面

2026 年 1 月 2 日,英國《衛報》刊出調查報導:Google 搜尋頂端的 AI Overviews 生成摘要,在健康查詢上給出錯誤或誤導資訊,Pancreatic Cancer UK、British Liver Trust、The Eve Appeal、Mind 等慈善機構警告,民眾可能因此暴露於實際傷害。

AI Overviews 出包不是新聞;這次的差別在證據的具體程度——每個錯誤都有對應的疾病、查詢方式與具名專家背書。對做搜尋、摘要或 RAG 產品的團隊,這份清單值得逐條檢視。

四個具體出錯案例

調查聚焦四類查詢。胰臟癌:摘要建議患者避免高脂食物,Pancreatic Cancer UK 的 Anna Jewell 直指「完全錯誤」——胰臟癌患者反而需要足夠熱量,錯誤建議可能讓他們在化療或手術前體重流失,危及治療。

肝功能血液檢查:摘要丟出一大堆「正常範圍」數字,卻完全沒有年齡、性別等背景脈絡。British Liver Trust 執行長 Pamela Healy 警告,無症狀的嚴重肝病患者可能誤以為自己一切正常,進而跳過後續追蹤。

陰道癌:摘要把子宮頸抹片(pap test)列為診斷工具——事實上並非如此。The Eve Appeal 執行長 Athena Lamnisos 指出,女性可能在抹片結果正常後輕忽症狀、延誤就醫;她還觀察到同一查詢每次重跑,答案都不一樣。

心理健康:精神病與飲食障礙相關查詢的摘要,被 Mind 的 Stephen Buckley 形容為包含「非常危險的建議」,可能讓人不敢求診,或強化污名化的偏見。

Google 的回應

Google 發言人回應衛報時表示,報導中的許多例子是「不完整的截圖」,實際的 AI Overviews 都連向可靠來源;「絕大多數」AI Overviews 是準確的,正確率與既有精選摘要相當;當系統漏抓脈絡時,會依政策處置。

這個回應值得推敲:「與精選摘要相當」是把新產品的正確率錨定在一個既有爭議的基準上;「截圖不完整」的說法則恰好印證了問題——使用者看到的就是那段文字,不會先點開來源再判斷。

從 2024 年就存在的老問題

AI Overviews 於 2024 年 5 月隨 Google I/O 在美國全面上線,三週後 Google 就發過「關於上週」一文回應正確率爭議;同年 10 月擴到 100 多國、每月超過 10 億使用者;2025 年 5 月再擴至 200 多個國家與地區。規模一路放大,健康資訊正確性的結構性問題卻從第一天就在。

Patient Information Forum 的 Sophie Randall 與 Marie Curie 數位長 Stephanie Parker 點出問題的核心場景:「人們是在焦慮與危急的時刻轉向網路。」在這個情境下,答案的權威外觀本身就是風險放大器。

對搜尋與摘要產品的啟示

第一,非確定性在關鍵場景等於不可用。同一查詢每次答案不同,在醫療場景就是缺陷;快取與答案穩定化應列為基本需求。第二,出處要當成一級介面。生成摘要拿掉了點擊摩擦,同時拿掉了使用者交叉查證的動機;來源連結不能是灰字附註。第三,高風險域需要分級管線。醫療、法律、財務查詢應走更保守的檢索與生成策略——更強 grounding、更低生成自由度——而不是與一般查詢共用同一套參數。AI Overviews 每月觸及數以億計的使用者,它的錯誤樣態,就是所有摘要產品的免費教材。

參考來源

本文由 AI 協助自上述來源整理,經人工審核後發布。

分享X電郵