統計 108 年資料處理考古題
題目為考試當年公告版本,實務標準請以現行規範為準。
某執行機密業務之單位想要引進臉部辨識系統來管制門禁,公告後共有 甲、乙兩家公司來展示系統,以50 名員工及50 名其他人的臉孔照片建檔 進行辨識測試後,得出如下列的辨識結果: 甲公司 真實值 乙公司 真實值 類別 員工 其他人 類別 員工 其他人 辨識值 員工 45 15 辨識值 員工 35 5 其他人 5 35 其他人 15 45 若採用臉部辨識系統管制門禁後,人員經系統辨識為員工後,系統即解除 門禁讓人員直接進入辦公室。若工作人員臉部辨識失敗,也可連絡安全人 員解除門禁。請問應該採用那套系統?請說明所根據的人臉辨識績效指標 及決策依據為何?(30 分)
如下圖所示,傳統的程式開發根據需求將資料轉換規則以人工開發成為可 執行的軟體程式,此程式可將輸入資料轉換成所需要的輸出結果;而機器 學習則可由輸入資料及所要的輸出結果中學習、自動推導出轉換規則,但 推導出的規則可能是由機器學習系統內部大量的參數所組成,不像人工寫 出的規則符合人類的思考邏輯而較容易說明解釋。試舉一適當的例子,說 明比較這兩種方法的適用情境。(30 分) 傳統程式開發 規則 輸入資料 所要的結果 機器學習 所要的結果 輸入資料 規則
保密性、完整性與可用性(Confidentiality, Integrity, and Availability, CIA) 為公司組織考量資訊安全的核心概念,若你負責規劃一套供組織內部員工 使用的資料儲存空間(如網路儲存NAS 或私有雲),員工可自由使用這 儲存空間來存業務相關甚至是個人的資料,這時你需要檢核那些相關事 項,以確定所規劃之資料儲存系統符合CIA 的規範?(20 分)
在資料分析或應用資料建立預測模型時,常會遇到資料不完整的情況,也 就是一筆資料內含的一個或多個屬性欄位有遺闕值的情形。試說明碰到這 種情況時,在無法重新蒐集遺闕值的限制下,有那些可能處理的方法,並 請說明這些方法的適用情境與優缺點。(20 分)
依據我國「個人資料保護法」的規定,公務機關或非公務機關向當事人 蒐集個人資料時,除另有規定得免為告知的情形之外,應明確告知當事 人那些事項?(20 分)