跳到主要內容

114-4 科目一考古題詳解

人工智慧基礎概論,共 50 題。

  1. 1在人工智慧系統的決策流程中,下列哪一種情境最符合「人在迴圈上(Human-over-the-loop)」所強調的監督機制?
  2. 2下列哪一種特徵工程技巧,最適合將「星期幾」和「24 小時制時間」這兩個欄位結合,以預測通勤時間?
  3. 3關於 ETL(Extract-Transform-Load),下列敘述何者為正確?
  4. 4關於資料正則化(Regularization)L1、L2 方法,下列敘述何者正確?
  5. 5在機器學習中,「偏差與變異權衡(Bias-Variance Tradeoff)」主要用來解決下列哪一類型的問題?
  6. 6在 Lasso 模型中,L1 正則化(Regularization)導致參數收斂為零的原因為何?
  7. 7貝氏分類器(Naive Bayes Classifier)常被應用於文字分類、垃圾郵件過濾等場景。依據模型特性,它最適合歸類於下列哪一類?
  8. 8為提升生成式 AI 系統回應的語境一致性,常會結合哪類模型技術?
  9. 9根據 2025 年 9 月行政院通過之《人工智慧基本法》草案,政府推動人工智慧之「創新實驗環境」制度,主要參考歐盟的何種制度?
  10. 10根據《金融機構運用人工智慧技術作業規範》,金融機構須建立內部治理架構,並指定專責單位或人員負責推動及管理人工智慧事務,下列何者並非規範所明訂須落實的治理措施?
  11. 11下列哪一類問題最適合使用非監督式學習(Unsupervised Learning)來處理?
  12. 12下列哪一種圖表最適合用來呈現並分析「兩個數值型變數」之間的關係,例如觀察身高與體重的相關性?
  13. 13下列哪一項應用情境與機器學習類型搭配正確?
  14. 14某企業分析團隊正在處理一組近兩年的營運與銷售數據,共有四個部門提出了各自的分析需求,請判斷哪一個最接近「預測性分析(Predictive Analysis)」的特性?
  15. 15某模型使用 K-近鄰演算法(KNN)進行分類,K 設為 3。一筆新的測試資料輸入後,與其最接近的 3 筆資料的類別如下:鄰近樣本 1:類別 A;鄰近樣本 2:類別 B;鄰近樣本 3:類別 A。請問模型會將這筆資料預測為哪一類別?
  16. 16某團隊想採用循環神經網路(Recurrent Neural Network, RNN)建構長期氣候數據的預測模型,以下哪一項敘述最符合使用 RNN 可能會遇到的挑戰?
  17. 17一間金融科技公司設計一款智慧投資系統,該系統會根據市場變化自動決定「買進」、「持有」或「賣出」的行動,並根據每次交易後的盈虧結果,逐步優化下一次的投資策略。整個過程中,系統不依賴事先標記的資料,而是根據歷次行動獲得的獎勵進行調整。請問此系統最可能採用哪一種學習方法?
  18. 18關於 Q-Learning 與 Deep Q-Learning,下列敘述何者最正確?
  19. 19在訓練機器學習模型時,若任務為預測房價,應選用下列哪一種損失函數(Loss Function)來衡量預測誤差?
  20. 20某醫院希望開發一個系統,根據患者的年齡、血壓與 BMI 等資訊,預測其罹患糖尿病的機率(0~1),並依據預測值是否超過 0.5 做出風險警示。下列哪一種模型最適合用於此分類任務?
  21. 21某金融科技公司正開發一套違約風險預測系統,需大量處理不同客戶的財務特徵資料。考量到資料特徵數量眾多,且希望提升預測的穩定性與泛化能力,下列哪一種鑑別式 AI 模型最適合?
  22. 22關於變分自編碼器(Variational Autoencoder, VAE)的運作流程,下列何者敘述最為正確?
  23. 23下列何者不是我國數位發展部 AI 產品與系統評測中心對生成式 AI 的評測項目?
  24. 24在保持 GPT-OSS 模型架構不變的前提下,如果將模型參數量從 20 億提升至 120 億,並假設有足夠的訓練資料支撐,下列敘述何者最正確?
  25. 25在自然語言處理任務中,為了減少訓練語料中偏見對模型的影響,下列哪種資料處理策略屬於常見的「資料去偏(Data Debiasing)」做法?
  26. 26在深度學習模型的微調(Fine-tuning)過程中,可能出現所謂的「災難性遺忘(Catastrophic Forgetting)」。此現象最可能造成哪種情況?
  27. 27在大型 Transformer 模型的效能優化過程中,常見的方法之一是「剪枝(Pruning)」。下列哪一項最符合該方法的核心概念?
  28. 28對非常長的輸入序列進行推理(Inference),Transformer 模型推理的主要計算瓶頸通常是什麼?
  29. 29在「可解釋人工智慧(Explainable AI, XAI)」領域中,LIME(Local Interpretable Model-agnostic Explanations)方法最核心的應用目的是什麼?
  30. 30在醫療診斷決策支援系統等高風險領域中,「可解釋人工智慧(Explainable AI, XAI)」的核心價值最主要呈現在哪個面向?
  31. 31在金融科技公司的信貸決策系統中,導入反事實解釋(Counterfactual Explanation)時,實際部署往往伴隨技術與監管挑戰。下列哪一項最符合該情境下的核心挑戰?
  32. 32在統計推論中,若樣本來自母體但呈現明顯偏態分布,且樣本數有限,下列哪一項策略最能減少推估母體參數的偏誤?
  33. 33在工業物聯網架構中,進行設備預測性維護(Predictive Maintenance)時,若面對異常事件發生頻率極低、樣本高度不平衡的時間序列資料,下列哪一種方法最能兼顧模型穩定性與異常偵測效能?
  34. 34在零售業進行客戶行為分析時,資料倉儲中發現多個欄位儲存相同的購買金額資訊(例如:amount_usd、total_price、transaction_value),但其單位、命名慣例及格式不一致,進而導致特徵工程階段混淆模型輸入。針對此種跨欄位語義重疊與結構冗餘問題,下列哪一種資料處理策略最合適且具實務可行性?
  35. 35某大型零售企業準備將商品推薦模型上線,專案團隊在檢視訓練資料時,發現部分商品類別(例如高價商品)樣本數量極少,而多數樣本集中於低價商品。若此不平衡問題未妥善處理,下列何種狀況最可能在實際推薦結果中發生?
  36. 36某電商資料團隊要協助行銷部門規劃再行銷策略。目前取得資料包含使用者點擊、購買紀錄、流量來源與轉換率。若資料團隊希望先進行探索性資料分析(EDA),下列哪一項最符合 EDA 的做法?
  37. 37某金融科技公司在利用歷史交易資料建立風險控管模型時,嘗試推估整體詐騙交易比例。近期發現,樣本間存在明顯的時間序列相關性,導致模型在實際偵測新交易時誤判率升高。若希望同時改善詐騙比例推估的準確性並提升模型的穩健性,下列哪一種做法最為合適?
  38. 38某公司建置基於檢索增強生成(RAG)的知識查詢系統,需同時兼顧查詢效能與資料的即時更新。近期發現回應內容偶爾過時,且每次更新文件都需完整重建索引,導致系統在更新期間無法服務。若要解決此問題並提升整體穩健性,下列哪項做法最適合?
  39. 39某醫院計畫開發住院日數預測模型,以協助病房調度。多數病人的住院日數集中在 3–7 天,但仍有少數重症患者因治療需求而住院日數明顯偏長。醫院希望採用一種合適的評估方式,既能兼顧大部分病人的預測準確度,也能確保對重症個案的預測維持穩健。下列哪一種方法最符合此需求?
  40. 40關於監督式學習(Supervised Learning)與非監督式學習(Unsupervised Learning)的目標,下列敘述何者錯誤? 1.非監督式學習的核心在於發掘資料內在結構,例如分群、關聯規則與降維,而不依賴外部標籤。 2.監督式學習的典型應用為分類與迴歸,通常不適合應用於異常偵測任務。 3.非監督式學習若搭配少量標註資料,即會完全轉化為監督式學習。 4.監督式學習仰賴已標註的資料集,透過最小化輸出與真實標籤之間的差距,學習輸入與目標之間的對應函數。 5.所有監督式學習任務都必須要有大量完整標註資料,否則無法進行任何有效的模型訓練。 6.非監督式學習不需要目標變數,僅透過輸入資料本身的特徵分布進行模式學習。
  41. 41一家旅遊平台希望建立模型,預測顧客下次是否會再次透過該平台訂房。資料包含:顧客 ID、年齡、旅遊次數、平均花費金額、主要交通方式(火車/飛機/自駕/公車)、會員等級(普通/進階/白金)、是否為海外旅遊等。下列哪一種特徵工程方法最適合處理「主要交通方式」欄位?
  42. 42一家跨國醫療研究機構希望利用各地醫院的病患資料,建立一個能夠預測疾病早期風險的機器學習模型。由於各國法規限制,病患的原始資料無法集中到單一伺服器。在此情境下,下列哪一種方法最能同時滿足「各醫院保留資料不外流」與「模型仍能跨院學習」的需求?
  43. 43某公司欲建立員工離職風險預測模型,資料集中包含「年度績效分數」、「平均每月加班時數」、「年齡」等數值型特徵。由於各特徵的數值範圍差異極大(例如績效分數 1–5、加班時數 0–80、年齡 20–65),若直接輸入至使用梯度下降的邏輯迴歸(Logistic Regression)模型,可能導致模型收斂緩慢或權重偏斜。為提升模型訓練效率與準確度,下列哪一種特徵工程方法最適合應用於這些數值特徵?
  44. 44在機器學習中,「叢集(Clustering)」方法最典型的應用情境是下列何者?
  45. 45某醫院研究團隊蒐集了大量病患的「收縮壓」數據,經檢驗後顯示此數值大致呈現常態分布。在進行後續模型分析前,研究人員希望妥善處理可能存在的極端血壓數值。下列哪一種做法最為合適?
  46. 46某電商公司想預測用戶是否會購買特定商品,資料中包含多種用戶屬性與行為特徵。分析師希望選出對購買結果最有預測價值的特徵,以提升模型效能。下列哪一種描述最符合監督式特徵選擇(Supervised Feature Selection)的概念?
  47. 47在訓練神經網路時,為了提升模型收斂速度與穩定性,避免梯度消失或梯度爆炸,下列哪一種做法最常被使用?
  48. 48若希望檢視某一連續型數據的分布情形(如集中程度、偏態或是否呈現多峰),下列哪一種應用情境最適合使用直方圖(Histogram)來進行分析?
  49. 49下列何者並非我國數位發展部 AI 產品與評測中心在評估大型語言模型安全性時,所指出的常見使用指標?
  50. 50某雲端服務公司計畫將大型語言模型部署於線上系統,並以批次推論(Batch Inference)方式處理每日上百萬筆用戶請求。專案團隊在評估可能遇到的挑戰時,下列哪一項通常不會被視為批次推論階段的主要難題?