データレイク とは

データレイクは、大規模な非構造化データ(正規化や統合などを行っていないオリジナルのデータ)を保管するためのストレージ領域を指します。データレイクには、フラットファイルシステムをサポートするコンピューターからメインフレームまで、様々なマシンを活用できます。ここでのデータの操作(データを構造化するなど)は、他のサーバーにデータを転送して実行されます。SNSやIoTから膨大な量のビッグデータが生まれる現代では、Hadoop Distributed File System(HDFS)等のツールを用いて、データ処理の高速化が図られます。

関連記事

  1. コラムとは

  2. ディザスタリカバリとは

  3. 摂取時安全目標値FSOとは

  4. 情報セキュリティポリシーとは

  5. IceIDとは

  6. インテグレーターとは

  7. ラテラルムーブメントとは

  8. ポンチ絵とは

  9. RJPとは