關於機器學習不同的學習模式,下列敘述何者錯誤? 1. 監督式學習透過已標註資料學習輸入與目標之間的對應關係,常見任務包含分類與數值預測。 2. 非監督式學習雖不需標註資料,但通常需預先定義每筆資料的正確輸出類別以利模型收斂。 3. 半監督式學習在訓練過程中僅利用未標註資料進行特徵學習,並不涉及標註資料。 4. 自監督式學習的訓練方式與監督式學習相同,皆需人工逐筆提供標註資料。 5. 強化式學習透過與環境互動並依據回饋訊號調整策略,以優化決策行為。 6. 自監督式學習通常利用資料本身產生訓練目標,以降低對人工標註資料的依賴。
答案 (D) ※本題要選的是敘述有誤/不符合的那一個
核心概念
這題要逐句判斷真偽,關鍵在三個容易被寫反的定義——非監督式不需要任何預先定義的輸出類別、半監督式必須同時使用標註與未標註資料、自監督式是從資料本身自動產生標籤而非人工標註。
詳解
核心概念:這題要逐句判斷真偽,關鍵在三個容易被寫反的定義——非監督式不需要任何預先定義的輸出類別、半監督式必須同時使用標註與未標註資料、自監督式是從資料本身自動產生標籤而非人工標註。
正確:(D) 錯誤的敘述是第 2、3、4 句。
・第 2 句錯:非監督式學習根本不需要預先定義正確輸出類別,若需要就不叫非監督式了,前後自相矛盾。
・第 3 句錯:半監督式學習的定義正是「同時使用少量標註資料與大量未標註資料」,說它「僅利用未標註資料、不涉及標註資料」就變成非監督式學習了。
・第 4 句錯:自監督式學習的精髓是從資料本身自動建構訓練目標(例如遮住句中某個詞讓模型預測、或預測影像被旋轉的角度),不需要人工逐筆標註。
錯誤(即這些敘述本身正確,不該被選):
第 1 句正確:監督式學習的標準定義,分類與迴歸都是其典型任務。
第 5 句正確:強化式學習透過環境互動與回饋訊號優化策略,定義無誤。
第 6 句正確:自監督式學習利用資料本身產生訓練目標,降低對人工標註的依賴,是它最重要的價值。
答題技巧
快速判斷技巧:用刪去法最快。第 5 句是強化學習的標準定義(正確),含 5 的 (B) 先刪;第 1 句是監督式學習的標準定義(正確),含 1 的 (C) 刪;第 6 句是自監督式學習的標準定義(正確),含 6 的 (A) 刪。三刀砍完只剩 (D),完全不必判斷剩下三句。
易錯陷阱:第 4 句與第 6 句都在講自監督式學習,而且說法互相矛盾(一個說需要人工標註、一個說降低人工標註依賴)——出題者刻意讓兩句打架,只要判斷出哪一句對,另一句必錯。看到同一主題出現兩句矛盾敘述,先解這一組,效率最高。