エントリーの編集
エントリーの編集は全ユーザーに共通の機能です。
必ずガイドラインを一読の上ご利用ください。
データ基盤の歴史と最新トレンド「データレイクハウス」について
記事へのコメント0件
- 注目コメント
- 新着コメント
このエントリーにコメントしてみましょう。
注目コメント算出アルゴリズムの一部にLINEヤフー株式会社の「建設的コメント順位付けモデルAPI」を使用しています
- バナー広告なし
- ミュート機能あり
- ダークモード搭載
関連記事
データ基盤の歴史と最新トレンド「データレイクハウス」について
この記事では、データ基盤がどのように進化してきたかを歴史から整理した上で、最新トレンドである「デ... この記事では、データ基盤がどのように進化してきたかを歴史から整理した上で、最新トレンドである「データレイクハウス」の仕組みを体系的に解説します。 データ基盤の歴史(3世代) 現在のデータ基盤アーキテクチャは、大きく3つの世代に分けて理解できます。 世代が進むにつれて、「データをどこに保存するか」と「どうやって加工するか」 の2点が変化してきました。 第1世代:オンプレミスDWH(〜2012年頃) この時代のデータ基盤は ETL(Extract → Transform → Load) と呼ばれる方式が主流でした。 データベースのストレージ容量もCPU処理能力も非常に高価だったため、データをDBに入れる前に、別のサーバーで不要なデータの除去やフォーマット変換などの加工処理(Transform)を行い、きれいになったデータだけをDBにロード(Load)するという流れです。 課題 専用DBサーバー

