ファイル重複排除
ふぁいるじゅうふくはいじょ
意味
ファイル重複排除とは、ストレージシステム内にある同一のデータブロックを検出して統合し、物理的な保存領域を効率的に削減するデータ最適化技術のことです。主な仕組みとして、ファイル全体を比較する方式のほか、データを細かなブロック単位に分割して一意のハッシュ値を算出し、完全に一致するものを探す方式が広く採用されています。これにより、同じ内容のファイルやデータがネットワーク上やディスク内に複数存在する場合であっても、実際のデータは一つだけが物理的に保持され、他の場所からはその実データへの参照情報のみが保持される仕組みとなります。バックアップシステムや仮想化基盤、大規模なアーカイブストレージなどにおいて、限られた記憶容量を最大限に有効活用するための不可欠な基盤技術として普及が進んでおり、現代のITインフラストラクチャにおけるデータ管理の効率化に寄与しています。
類義語
データ重複排除、デデュープリケーション