Skip to content

DNET_ApacheHBase

nishi_74322014 edited this page Sep 11, 2026 · 1 revision

Apache HBase

概要

  • Javaにより書かれている。
  • Powerset社において自然言語処理を行うため、
    大規模データの処理プロジェクトとして始まった。

詳細

特徴

  • オープンソースの、列(カラム)指向型、分散データベース。
    HDFS(Hadoopの該当節を参照)を活用する。
  • ビッグデータに対してランダムなリアルタイムの読み書きアクセスを行う必要がある場合に使う。
    普通のハードウェアのクラスタ上で、数十億行 x 数百万列規模の超巨大テーブルを格納できる。

機能

  • HDFS(Hadoopの該当節を参照)の上でGoogleのBigTableのような機能を提供する。
    MapReduce(Hadoopの該当節を参照)ジョブではなくデータベース上でリアルタイムに実行される。

    • 圧縮
    • インメモリ処理
    • 各列毎にブルームフィルタ
  • 独自のメタデータリポジトリとカラム型ストレージレイアウトがある。

    • テーブルはHadoop上のMapReduceジョブの入出力として機能
    • Java APIのほか、REST、Avro、ThriftといったゲートウェイAPIを通じアクセス可能
  • クエリ

    • カスタム言語でパーサ、クエリプランナ、クエリ実行エンジンを利用できる。
    • 完全にACIDに準拠しておらず、複雑なアクセスパターン(結合など)は使用できない。
    • 近年ではパフォーマンスが向上し、データ駆動型のWebサイトでも使用されている。

参考

移行メモ

  • 本文中の HDFS へのリンクが #l2a0cd99Hadoop 側のアンカ)を 本ページ内アンカとして参照しており解決できなかったため、 Hadoop の該当節への参照に置き換えた。

Tags: 移行, Apache HBase, NoSQL, 列指向, HDFS, Hadoop, BigTable

NetDevInfraWiki

マイクロソフト系技術情報 Wiki
Open 棟梁 Wiki

(未着手)

開発基盤部会 Wiki

移行管理: DONETODO

Clone this wiki locally