地特四等申論題
114年
[圖書資訊管理] 資訊系統與資訊檢索概要
第 一 題
📖 題組:
以下是一個典型的混淆矩陣(Confusion Matrix) | | 判定為正類 P | 判定為負類 N | |---|---|---| | 實際為正類 P | TP(正確判定為正類) | FN(誤判正類為負類) | | 實際為負類 N | FP(誤判負類為正類) | TN(正確判定為負類) | (一)若將其應用於資訊檢索系統之成效評估時,試闡述其中的 TP、FP、FN、TN 所代表之意涵。(20 分) (二)假設 TP=40、FP=10、FN=15、TN=35,試問資訊檢索之查準率(Precision,又稱精確率)與查全率(Recall,又稱回收率)分別為多少?(5 分)
以下是一個典型的混淆矩陣(Confusion Matrix) | | 判定為正類 P | 判定為負類 N | |---|---|---| | 實際為正類 P | TP(正確判定為正類) | FN(誤判正類為負類) | | 實際為負類 N | FP(誤判負類為正類) | TN(正確判定為負類) | (一)若將其應用於資訊檢索系統之成效評估時,試闡述其中的 TP、FP、FN、TN 所代表之意涵。(20 分) (二)假設 TP=40、FP=10、FN=15、TN=35,試問資訊檢索之查準率(Precision,又稱精確率)與查全率(Recall,又稱回收率)分別為多少?(5 分)
📝 此題為申論題,共 2 小題
小題 (一)
若將其應用於資訊檢索系統之成效評估時,試闡述其中的 TP、FP、FN、TN 所代表之意涵。(20 分)
思路引導 VIP
在資訊檢索情境中,必須將機器學習的分類名詞轉換為圖資專業術語。解題關鍵是將「正類(P)」對應為「與查詢相關的文件(Relevant)」,「負類(N)」對應為「不相關的文件(Non-relevant)」。而系統「判定為正類」代表「系統檢索出該文件(Retrieved)」,「判定為負類」代表「系統未檢索出(Not retrieved)」。將這個對應關係帶入 TP, FP, FN, TN 解釋即可。
小題 (二)
假設 TP=40、FP=10、FN=15、TN=35,試問資訊檢索之查準率(Precision,又稱精確率)與查全率(Recall,又稱回收率)分別為多少?(5 分)
思路引導 VIP
直接套用 Precision 與 Recall 的公式計算。Precision 是系統檢索出來的文件中,真正相關的比例;Recall 是資料庫裡所有真正相關的文件中,被系統檢索出來的比例。寫出公式,代入數字,並算出最終答案。