某醫院計畫開發住院日數預測模型,以協助病房調度。多數病人的住院日數集中在 3–7 天,但仍有少數重症患者因治療需求而住院日數明顯偏長。醫院希望採用一種合適的評估方式,既能兼顧大部分病人的預測準確度,也能確保對重症個案的預測維持穩健。下列哪一種方法最符合此需求?
答案 (A)
核心概念
當資料分布長尾、群體性質差異大時,只看一個整體指標會掩蓋少數群體的問題——整體誤差很漂亮,重症病人卻預測得一塌糊塗。正確做法是「整體指標 + 分群評估」:用平均絕對誤差(MAE,對極端值較不敏感)看整體表現,同時單獨計算重症子群的誤差,確保沒有任何一群被犧牲掉。
答題技巧
快速判斷技巧:題目說「既要……也要……」,就是在要求「多個指標/分群評估」。選項裡只要出現「單一指標」「只針對某一群」,都跟題意相反,直接刪。
易錯陷阱:(B) 用「避免重症個案拉高誤差」包裝得像是合理的技術考量,但這是在挑資料讓成績變好,屬於評估上的作弊。判準很簡單:模型上線要面對的樣本,評估時就不能排除。