Options
利用預訓練語言模型提升急診部電腦斷層掃描檢測之成效
Other Title
Enhancing the Effectiveness of Emergency Department Computed Tomography Scans Using Pre-Trained Language Models
Type
thesis
Date Issued
2024-06-17
Author(s)
林亨優
Advisor
張詠淳
Subjects
系所名稱:大數據科技及管理研究所碩士班
Publisher
大數據科技及管理研究所碩士班
Description
學位別:碩士
關鍵字: 電腦斷層檢查; 大型語言模型; 預訓練模型; 自然語言處理; 提示詞微調
論文公開日期:2024-07-05
關鍵字: 電腦斷層檢查; 大型語言模型; 預訓練模型; 自然語言處理; 提示詞微調
論文公開日期:2024-07-05
Abstract
當前醫療領域正在經歷智慧化轉型,其核心目標是提升治療的迅速性和精確度,這種轉變在醫學與人工智慧技術的結合上尤為顯著,尤其是大型語言模型在處理醫療數據上的應用。大型語言模型的出現有助於減輕急診科醫護人員的工作壓力,提高病患管理效率。如今急診科正面臨著處理多變醫療需求和供需不平衡的挑戰,所以及早辨識病患處置非常重要,尤其是在電腦斷層處置辨識方面。因此,開發能準確初診分類和提供及時處置的輔助系統,對於提高醫療效率和應對人力不足至關重要。觀察資料集過後,發現我們的資料集存在著嚴重資料不平衡的狀況,所以為了應對不平衡問題,我們計劃透過運用大型語言模型來進行少數類別的資料增量。這一策略將使模型能夠接觸到更多元化的資訊,從而提高其在學習和訓練過程中對稀有但重要類別的識別能力。一方面模型能夠學習到常見類別的特徵,另一方面也能夠捕捉到那些在數據集中出現頻率較低的關鍵特徵。除了資料增量之外,我們還將從臨床文本中提取關鍵的臨床特徵「疼痛指數」作為外部知識融入模型中。通過整合這些臨床特徵,模型將能夠更全面地理解患者的健康狀況,進行更加縝密的學習。
實驗結果表明,研究所提出的模型在效能方面顯著優於傳統機器學習模型,尤其在處理不平衡數據時更為突出。使用AUPRC作為評估指標時,預訓練模型的性能優勢更加明顯,本實驗提出之模型效能為AUROC=0.8808、AUPRC=0.5414,值得一提的地方是其AUPRC比傳統模型高出近20%,顯示出在處理包含少量關鍵正樣本的不平衡數據集時的卓越預測精確度。綜上實驗結果,我們所提出的模型在與現有的診斷方法相比時,展現出了優異的性能這顯著的進步使我們更接近於實現最有效和精確的電腦斷層掃描處置目標。這是由於模型深入融合的醫學專業知識和創新的模型架構,使得它能夠對臨床病歷進行更細致和精確的分析和解釋,從而提供更可靠的診斷結果。此外,透過數據增量和引入外部知識特徵,讓模型得以更全面地學習和理解病患的狀態,不僅有助於識別典型的病理特徵,還能捕捉到對臨床處置來說極為關鍵的臨床情況,為醫生提供更豐富的信息以作出更準確的臨床決策,提高診斷的準確性和可靠性。綜合來看,我們的模型結合了最新的技術創新和深厚的臨床知識,為提高醫療診斷的準確性和效率開辟了新的道路。
實驗結果表明,研究所提出的模型在效能方面顯著優於傳統機器學習模型,尤其在處理不平衡數據時更為突出。使用AUPRC作為評估指標時,預訓練模型的性能優勢更加明顯,本實驗提出之模型效能為AUROC=0.8808、AUPRC=0.5414,值得一提的地方是其AUPRC比傳統模型高出近20%,顯示出在處理包含少量關鍵正樣本的不平衡數據集時的卓越預測精確度。綜上實驗結果,我們所提出的模型在與現有的診斷方法相比時,展現出了優異的性能這顯著的進步使我們更接近於實現最有效和精確的電腦斷層掃描處置目標。這是由於模型深入融合的醫學專業知識和創新的模型架構,使得它能夠對臨床病歷進行更細致和精確的分析和解釋,從而提供更可靠的診斷結果。此外,透過數據增量和引入外部知識特徵,讓模型得以更全面地學習和理解病患的狀態,不僅有助於識別典型的病理特徵,還能捕捉到對臨床處置來說極為關鍵的臨床情況,為醫生提供更豐富的信息以作出更準確的臨床決策,提高診斷的準確性和可靠性。綜合來看,我們的模型結合了最新的技術創新和深厚的臨床知識,為提高醫療診斷的準確性和效率開辟了新的道路。