跳到主要內容
2.3 生成式 AI 風險管理
114-4 科目 10

某公司在導入生成式 AI 協助撰寫內部報告時,測試人員刻意在輸入的上下文中放入互相矛盾的資訊(例如:同一位員工在不同段落被描述為「入職三年」與「入職五年」)。在這種情況下,最常見的模型行為會是什麼?

請選擇一個答案

答案 B

核心概念

大型語言模型的本質是根據上下文預測下一個詞的機率分布,它並沒有一套獨立的事實查核或矛盾偵測機制。當上下文本身互相打架時,模型不會停下來,而是照樣生成——可能挑其中一個說法、可能混合兩者、也可能生出第三個根本沒出現過的數字(幻覺)。行為是不穩定的。
答題技巧

快速判斷技巧:凡是描述模型行為的選項,帶有「永遠」「自動判斷正確」「一定會拒絕」這類絕對或高估能力的字眼,通常都是錯的。含有「可能」「不穩定」「幻覺」的保守敘述才符合實情。

易錯陷阱:(D) 反映了對 AI 的過度期待——很多人以為模型「應該會分辨對錯」。要記住:模型只知道語言的機率,不知道世界的真相。輸入有矛盾,輸出就有風險。