下列何者並非我國數位發展部 AI 產品與評測中心在評估大型語言模型安全性時,所指出的常見使用指標?
答案 (A) ※本題要選的是敘述有誤/不符合的那一個
核心概念
評估大型語言模型的「安全性」,關心的是模型輸出可能造成的危害風險,常見面向包括:會不會胡說八道(事實正確性/幻覺)、會不會歧視特定族群(偏見與歧視)、會不會被拿去做壞事或產生有害內容(惡意與濫用可能性),以及隱私外洩、有害言論等。這些指標的共同點是——都在衡量「輸出對人的風險」。
答題技巧
快速判斷技巧:先圈「並非」。接著用一句話判斷:這個指標是在衡量「輸出會不會傷害到人」嗎?(B)(C)(D) 都是,(A) 講的是資料本身的性質,不是輸出風險,答案就是它。
易錯陷阱:這題與第 23 題是同一組考點(數位發展部評測中心),建議一起記。共通判準是——評測構面談的是風險與信任(正確、公平、安全、隱私、當責),凡是描述技術難度、系統效能或使用者體驗的,都不在名單上。