第70号コラム「大容量化するデータの中から」
第70号コラム:芝 啓真(株式会社フォーカスシステムズ フォレンジックセキュリティ室、IDF幹事)
題:「大容量化するデータの中から」
昨今、ハードディスク(HDD)の容量は増加の一途をたどっています。まだ私が学生だった頃は、“ギガバイト(GB)”と聞くと非常に大きなデータ量だと感じていました。しかし、最近では1テラバイト(TB)の容量を持つレコーダが発売されたり、小さなモバイルPCにも数百ギガバイトのHDDが搭載されていたりしています。TBの一つ上のペタバイト(PB)が当たり前になる時代もそう遠い将来でないと感じます。
このようなHDDの容量の増加に伴って、保存されているデータの数量も非常に増加してきています。しかしe-Discoveryにおいて、証拠として提出が必要なデータを効率よく絞り込むことは、非常に重要であり、訴訟コストを左右する重要なファクタとなり得ます。大量のデータの絞り込みの手法としては、de-Duplication(重複するファイルの削除)やキーワード検索による絞り込み、ファイル拡張子による絞り込みなどが挙げられます。
