タグ

関連タグで絞り込む (0)

  • 関連タグはありません

タグの絞り込みを解除

sparkに関するyusuke_fのブックマーク (1)

  • 次世代Hadoop最有力候補の「Spark」、動き始めたエコシステム

    次世代Hadoopの有力なビッグデータ分析基盤として期待を集めているフレームワークがある。Apache Software Foundation(ASF)のオープンソースソフト(OSS)プロジェクトである「Spark」だ。インメモリー処理が特徴で、Hadoopにおける処理方式の一つである「MapReduce」を用いた場合と比べて最大で100倍以上、分析処理を高速化できる。 Sparkは当初、研究用途として米University of California Berkeley(UCB)の研究組織「AMPLab」で誕生したものだが、2014年5月にはASFから「バージョン1.0」が公開された。研究用途のフェーズを脱し、企業が商用で使えるソフトを目指すことを宣言した形だ(関連記事:Hadoop超える機械学習向きのビッグデータ処理基盤、Spark 1.0が正式公開)。 Sparkに注目し、その動向に詳

    次世代Hadoop最有力候補の「Spark」、動き始めたエコシステム
    yusuke_f
    yusuke_f 2014/06/24
    メモリ、ガン積み前提で、インメモリーで処理させるから高速。
  • 1