ChatGPT取代Google大神提供治癌建議?最新研究警告:超過三成答案有問題
2022年11月人工智慧(AI)對話式機器人ChatGPT橫空出世,現在全球許多人依賴它真人般活靈活現的對話機能,不只寫給上司的報告、電子郵件靠它,連晚餐吃什麼、下班追什麼劇都問它的意見。
圖片來源 / Pixabay
一直以來都存在俗稱「Dr. Google」的現象,指的是很多人一覺得不舒服就上谷歌查症狀、搜解答,甚至拿找到的答案反過來質問醫師。最令人害怕的癌症也不例外,「凡事問ChatGPT」的浪潮隨即湧現。然而,ChatGPT給的答案可信嗎?
ChatGPT超過三成的回答出錯,超過一成提供虛假的療法
針對「ChatGPT給的答案可信嗎?」這個可能影響超過數百萬人的問題,美國哈佛大學醫學院教學醫院之一的布萊根婦女醫院(Brigham and Women’s Hospital)研究團隊於 2023 年 8 月下旬在頂尖醫學刊物《美國醫學會期刊腫瘤學(JAMA Oncology)》發布研究結果,敲響強有力的警鐘:ChatGPT超過三成的回答出錯,超過一成提供虛假的療法。【推薦閱讀:癌症第二意見何時問?怎麼問? 3 重點避 2 地雷 得到最好治療】
團隊聚焦在乳癌、肺癌和攝護腺癌 3 大常見癌症,比對ChatGPT的回答和美國國家癌症資訊網(National Comprehensive Cancer Network,簡稱NCCN)的治療準則,NCCN是各國醫師們普遍信任的癌症醫療資訊來源。
他們提出3個關鍵數字:
1.ChatGPT的回答幾乎(98.1%)都包含至少一項符合NCCN指南的治療方法。
2.超過三成(34.3%)的回答摻雜錯誤訊息。「錯誤」的意思是,ChatGPT給出一項或多項僅部分符合NCCN指南的療法。【推薦閱讀:父母罹癌後,什麼都不需要? 2 個重點,問出爸媽真正的需求】
作者之一、放射腫瘤科醫師碧特曼(Danielle Bitterman)接受美國媒體《Insider》訪問時警告:
錯誤和正確訊息無縫混在一起,「這使揪錯變得很困難,即使是專家也傷腦筋。」
有些錯誤更難察覺,是因為AI只說出一半事實,例如NCCN的局部晚期乳癌治療指南中,除了開刀,還包含化學治療等其他療法,ChatGPT卻僅只建議動手術。
3.超過一成(12.5%)的回答提出NCCN指南裡根本沒有的療法。這是對話式機器人長期以來被詬病的現象,即AI會製造出「幻覺(hallucination)」,意指很像真的但是錯誤的訊息。
團隊指出,幻覺主要出現在晚期癌的局部治療(編按:手術、放療等療法只針對病灶區域,因此稱為局部治療)、標靶治療或免疫治療的建議裡。
向人工智慧「求醫」 風險難料
這項新發現明確指出:向ChatGPT等運用大型語言模型(註)打造出來的人工智慧工具尋求醫療建議,有不少風險。【推薦閱讀:新研究:無形的線串起癌症、糖尿病,「胰島素阻抗」恐加速癌細胞生長】
碧特曼提醒:「大型語言模型經過訓練,可以說出聽起來很有說服力的回答,但它們不是為了提供準確醫療建議而設計的。」
她建議,患者理當探求自己的醫療狀況,不過病人應該持續和臨床醫師討論,也不可一味把網路上的訊息奉為圭臬。
註:大型語言模型(Large Language Model,簡稱LLM)是一種人工智慧技術,藉由類神經網路和內藏的大量參數來解析和自行生成人類語言,可以流利地和真人對話。
※加入癌症問康健官方LINE帳號,從症狀檢查、癌後治療、飲食營養、體能復健、財務規劃到身心療癒,都能找到解答:https://lin.ee/QCxb8mw
責任編輯: 梁惠明
我們的團隊由具有豐富醫學寫作經驗的記者、編輯組成,內容來自採訪諮詢資深癌症醫學和照護知識的專家與相關書籍,盡力提供正確可信的醫療健康知識。但無意取代專業醫師診斷,無法為個別讀者對內容的應用負醫療或法律責任。
