某銀行導入 AI 理財助理供行員查詢客戶資訊。上線後發現,系統在部分對話中主動提及特定客戶的資產規模與交易紀錄,但這些資訊並未出現在當次輸入中。經調查已排除外部入侵、資料庫存取異常與輸入觸發問題。請問下列何者最可能是此次事件的根本原因?
答案 (B)
核心概念
題幹用排除法把線索收得很窄——排除了外部入侵、資料庫存取異常、以及輸入觸發,代表資訊既不是被駭進來的、不是即時從資料庫撈出來的、也不是這次輸入帶進來的。那麼資訊只可能早就存在模型裡面。這就是訓練資料記憶(Memorization)問題:模型在訓練階段接觸了含真實客戶資訊的語料,把這些內容記進了權重,在特定情境下又原樣吐出來。這是使用真實個資做訓練時最典型的隱私風險。
答題技巧
快速判斷技巧:題幹用排除法列出「已排除某某原因」時,先把與這些條件衝突的選項砍掉(本題的 A 直接違反)。剩下的再比對症狀。
易錯陷阱:容易忽略「訓練資料記憶」這個風險,因為它不像駭客入侵那麼直觀。要記住一個原則:拿真實個資去訓練模型,模型就可能把它背起來再吐出來——這也是為什麼訓練前必須去識別化。