Options
使用縱向資料及機器學習方法預測發炎性腸道疾病患者治療後之效果
Other Title
Predicting the Outcomes of Inflammatory Bowel Disease Patients After Treatment Using Longitudinal Data and Machine Learning Methods
Type
thesis
Date Issued
2024-07-17
Author(s)
蔡君偉
Advisor
蘇家玉
Subjects
系所名稱:醫學資訊研究所碩士班
Publisher
醫學資訊研究所碩士班
Description
學位別:碩士
關鍵字:發炎性腸道疾病; 克隆氏症; 潰瘍性結腸炎; 發炎; 機器學習; 預測緩解
論文公開日期:2024-07-22
關鍵字:發炎性腸道疾病; 克隆氏症; 潰瘍性結腸炎; 發炎; 機器學習; 預測緩解
論文公開日期:2024-07-22
Abstract
研究背景:發炎性腸道疾病(Inflammatory Bowel Disease, IBD)是一種免疫失調的疾病。由於其成因複雜,且常與急性腸胃炎或腸道功能性障礙混淆,因此初期診斷不易。IBD患者的腸胃道會長期且反覆發炎,經常經歷腹瀉、腹痛或血便等症狀。如果未能及早治療,或者治療後發炎反應未能有效控制,患者可能需要使用進階藥物或接受手術治療。否則,長期累積的腸道損傷可能導致腸道狹窄、腸阻塞以及肛門瘻管等多種併發症。IBD是一種需要終身治療的疾病,近年來在台灣的盛行率有所上升。部分患者需要進階治療,包括使用生物製劑或接受手術。除了及早診斷外,能夠提前識別患者的發炎反應是否未受控制,並及時進行進階藥物或手術治療,成為重要的研究目標。
研究目的:由於影像學檢查取得不易且非常規檢查,因此本研究藉由分析臨床資料、實驗室資料,除了尋找臨床上最能顯示IBD患者緩解狀態的指標參數之外,還要以這些指標參數建構IBD緩解的預測模型。
研究方法:我們使用ICD-9和ICD-10代碼在臺北醫學大學臨床研究資料庫中進行搜索,涵蓋潰瘍性結腸炎(Ulcerative Colitis, UC)和克隆氏症(Crohn's Disease, CD)。我們將提取自2004年至2022年期間診斷為IBD的患者的臨床資料和血液檢測資料,年齡為18歲以上,研究使用邏輯回歸和隨機森林等機器學習方法來構建IBD患者緩解狀態的預測模型,資料整理及統計分析使用SAS和Python進行。針對連續變數,我們使用獨立t檢定來比較其平均數是否具有顯著差異;對於類別變數,使用卡方檢定來檢驗類別變數與應變數之間是否具有獨立性,最後我們使用Python來構建機器學習預測模型。
研究結果和結論:我們總共納入1,147名UC和CD患者,其中預後患者良好為1,073人,預後不好患者為74人。在預測IBD患者的預後結果上,模型整體的AUC達0.91 ± 0.04,針對預後不良的患者,模型的Recall達到0.98 ± 0.03。在5次外部驗證中,Recall的值也都有達到0.73~0.87,展現良好的結果以及穩定性。本研究成功開發了一個能夠準確預測IBD患者預後不良的模型,並在內部與外部驗證中均顯示出卓越的性能,特別是在未見過的資料上仍具有良好且穩定的表現。我們發現了Albumin 為模型預測時的最強變數,這些發現為臨床決策提供了有價值的信息,儘管我們也面臨資料缺失和特徵選擇等挑戰。
關鍵字:發炎性腸道疾病、克隆氏症、潰瘍性結腸炎、發炎、機器學習、預測緩解
研究目的:由於影像學檢查取得不易且非常規檢查,因此本研究藉由分析臨床資料、實驗室資料,除了尋找臨床上最能顯示IBD患者緩解狀態的指標參數之外,還要以這些指標參數建構IBD緩解的預測模型。
研究方法:我們使用ICD-9和ICD-10代碼在臺北醫學大學臨床研究資料庫中進行搜索,涵蓋潰瘍性結腸炎(Ulcerative Colitis, UC)和克隆氏症(Crohn's Disease, CD)。我們將提取自2004年至2022年期間診斷為IBD的患者的臨床資料和血液檢測資料,年齡為18歲以上,研究使用邏輯回歸和隨機森林等機器學習方法來構建IBD患者緩解狀態的預測模型,資料整理及統計分析使用SAS和Python進行。針對連續變數,我們使用獨立t檢定來比較其平均數是否具有顯著差異;對於類別變數,使用卡方檢定來檢驗類別變數與應變數之間是否具有獨立性,最後我們使用Python來構建機器學習預測模型。
研究結果和結論:我們總共納入1,147名UC和CD患者,其中預後患者良好為1,073人,預後不好患者為74人。在預測IBD患者的預後結果上,模型整體的AUC達0.91 ± 0.04,針對預後不良的患者,模型的Recall達到0.98 ± 0.03。在5次外部驗證中,Recall的值也都有達到0.73~0.87,展現良好的結果以及穩定性。本研究成功開發了一個能夠準確預測IBD患者預後不良的模型,並在內部與外部驗證中均顯示出卓越的性能,特別是在未見過的資料上仍具有良好且穩定的表現。我們發現了Albumin 為模型預測時的最強變數,這些發現為臨床決策提供了有價值的信息,儘管我們也面臨資料缺失和特徵選擇等挑戰。
關鍵字:發炎性腸道疾病、克隆氏症、潰瘍性結腸炎、發炎、機器學習、預測緩解