刑事警察人員 100 年資料探勘技術考古題(共 4 題) 資料來源:考選部歷屆試題|法律人 LawPlayer 整理 https://lawplayer.com/exam/criminal-police/100-%E8%B3%87%E6%96%99%E6%8E%A2%E5%8B%98%E6%8A%80%E8%A1%93 第 1 題 請就㈠資料模型,㈡查詢方式,㈢查詢複雜度,㈣資料變動頻率四方面比較資料倉 儲與傳統資料庫之差異。(20 分) 第 2 題 請回答以下有關關聯法則(Association Rule)分析之問題: ㈠請舉例說明如何運用關聯法則於犯罪分析上。(10 分) ㈡對於一資料集,我們進行關聯法則探勘後可能會產生非常多的關聯法則,有些關 聯法則雖內容不同但彼此之間可能具有潛在之高度重複性(redundancy)。請說 明如何分析找出具有潛在高度重複性之關聯法則。(15 分) 第 3 題 分群(Clustering)是資料探勘中常用到的一種技術,請回答下列問題: ㈠請說明k-means 分群方法之運作方式。(15 分) ㈡請說明如何評估一個分群結果之好壞。(10 分) 第 4 題 請回答以下有關分類(Classification)之問題: ㈠決策樹(decision tree)與支持向量機(support vector machine,簡稱SVM)為分類 中常用之技術,請比較其優缺點。(15 分) ㈡請說明如何利用K-fold 交叉驗證(K-fold cross validation)來驗證分類模型之有效 性。(15 分) 題目為考試當年公告版本,實務標準請以現行規範為準。