圖書資訊管理 104 年資訊系統與資訊檢索概要考古題(共 4 題) 資料來源:考選部歷屆試題|法律人 LawPlayer 整理 https://lawplayer.com/exam/library-info-management/104-%E8%B3%87%E8%A8%8A%E7%B3%BB%E7%B5%B1%E8%88%87%E8%B3%87%E8%A8%8A%E6%AA%A2%E7%B4%A2%E6%A6%82%E8%A6%81 第 1 題 依據向量空間模式(Vector-Space Model)建構的資訊檢索系統,是將每一份文件表 達為對應的文件向量,請說明如何建構文件的向量,解釋文件向量分量(Component of Vector)的意義,並討論如何產生每一個分量的數值。(25 分) 第 2 題 許多資訊檢索系統在建構索引時,排除了停用詞(Stop Words),但是某些資訊檢索 系統,並不排除停用詞。請先說明何謂停用詞,繼之討論排除停用詞與不排除停用 詞的利弊得失。(25 分) 第 3 題 在大數據(Big Data,亦稱為巨量資料)的風潮下,圖書館界亦關心研究資料的典藏、 管理及使用,也就是近年備受關注的資料庋用(Data Curation)議題。圖書館若是提 供資料庋用的服務,則必須建構資料庋用系統,並提供檢索功能,請討論研究資料 的檢索與文件的檢索,在功能開發上,有何不同的考量。(25 分) 第 4 題 有一些資訊檢索系統提供同義處理、同音處理、近似處理或是詞幹處理(Stemming) 後的檢索等,我們可以將前述的處理都視為是建構等價群集(Equivalence Class),例 如相同意義的詞彙形成一個等價群集;發音相同的詞彙形成一個等價群集。請討論 提供前述處理功能的檢索系統,對於檢索績效(Performance)的正面與負面的影響。 (25 分) 題目為考試當年公告版本,實務標準請以現行規範為準。