普考-圖書資訊管理圖書資訊學概要115 年第 19 題單選題
有關資料去重(data deduplication),下列敘述何者正確?
A資料去重是為了清除資料的錯誤
B資料去重是為了建立資料的標記
C資料去重是為了去除重複的資料正確答案
D資料去重是為了增加資料的版本
C正確答案
資料去重(data deduplication)的核心目的就是消除資料庫或系統中的重複資料,以節省儲存空間並提升資料品質。
為什麼答案是 C
資料去重(data deduplication)正是為了識別並移除重複的資料副本,以最佳化儲存與管理效率。
載入中…
完整詳解
Pro · 無限重點 資料去重(data deduplication)的核心目的就是消除資料庫或系統中的重複資料,以節省儲存空間並提升資料品質。
看到『去重』,直覺聯想『去除重複』,字面意思即為正確答案,秒選 C。
逐選項分析
A✕
清除資料錯誤屬於資料清理(data cleaning)的範疇,主要處理錯誤、遺漏或不一致的資料。
B✕
建立資料標記屬於資料標註(data labeling),常用於機器學習訓練資料的前置準備。
C✓ 正確
資料去重(data deduplication)正是為了識別並移除重複的資料副本,以最佳化儲存與管理效率。
D✕
增加資料版本屬於版本控制(version control)的功能,用於追蹤修改歷史,與去重無關。
常見資料前處理與管理技術對照
| 技術名稱 | 英文 | 主要目的 |
|---|
| 資料去重 | Data Deduplication | 消除重複資料,節省儲存空間 |
| 資料清理 | Data Cleaning | 修正錯誤、填補遺漏值、處理異常值 |
| 資料標註 | Data Labeling | 為資料加上標籤,供機器學習模型訓練 |
| 版本控制 | Version Control | 追蹤資料或程式碼的修改歷史與版本 |
本題選項將『去重』與『清理』、『標註』等資料處理技術的名詞與功能進行偷換。考生需精確掌握各專有名詞的定義,避免被相似的資料處理流程名詞混淆而選錯。