跳到主要內容
2.3 生成式 AI 風險管理
114-4 科目 36

某航空公司導入生成式 AI 聲控客服,提供航班與票務查詢。有人員透過惡意提示,試圖讓系統洩漏內部安檢流程。在此情境中,下列何者為降低提示攻擊(Prompt Injection)風險的最佳策略?

請選擇一個答案

答案 A

核心概念

提示注入攻擊的手法是把惡意指令藏在使用者輸入裡,誘使模型忽略原本的系統指令。防禦要在「輸入」與「輸出」兩端同時設關卡:輸入端做檢測與過濾,攔下試圖改寫指令、套取內部資訊的可疑提示;輸出端做審核,即使模型被誘導產生了敏感內容,也在送出前被攔截。這種雙向防護(Guardrails)才是完整的策略。
答題技巧

快速判斷技巧:安全題找「主動偵測 + 雙向把關」的選項。凡是靠隱藏、靠隨機、靠對方猜不到的做法,在資安上一律不算有效防護。

易錯陷阱:(B) 相當合理,實務上也確實會做主題範圍限制,因此這題 (A)(B) 之間容易掙扎。官方取 (A) 的理由是它同時涵蓋了輸入與輸出兩道關卡,屬於針對攻擊行為本身的防禦;(B) 只是被動縮小暴露面。作答原則:問「防禦攻擊的最佳策略」時,選能主動偵測與攔截的那個。