-
Notifications
You must be signed in to change notification settings - Fork 0
DNET_ApacheHBase
nishi_74322014 edited this page Sep 11, 2026
·
1 revision
- Javaにより書かれている。
- Powerset社において自然言語処理を行うため、
大規模データの処理プロジェクトとして始まった。
- オープンソースの、列(カラム)指向型、分散データベース。
HDFS(Hadoopの該当節を参照)を活用する。 - ビッグデータに対してランダムなリアルタイムの読み書きアクセスを行う必要がある場合に使う。
普通のハードウェアのクラスタ上で、数十億行 x 数百万列規模の超巨大テーブルを格納できる。
-
HDFS(Hadoopの該当節を参照)の上でGoogleのBigTableのような機能を提供する。
MapReduce(Hadoopの該当節を参照)ジョブではなくデータベース上でリアルタイムに実行される。- 圧縮
- インメモリ処理
- 各列毎にブルームフィルタ
-
独自のメタデータリポジトリとカラム型ストレージレイアウトがある。
- テーブルはHadoop上のMapReduceジョブの入出力として機能
- Java APIのほか、REST、Avro、ThriftといったゲートウェイAPIを通じアクセス可能
-
クエリ
- カスタム言語でパーサ、クエリプランナ、クエリ実行エンジンを利用できる。
- 完全にACIDに準拠しておらず、複雑なアクセスパターン(結合など)は使用できない。
- 近年ではパフォーマンスが向上し、データ駆動型のWebサイトでも使用されている。
- Apache HBase - Wikipedia
https://ja.wikipedia.org/wiki/Apache_HBase
移行メモ
Tags: 移行, Apache HBase, NoSQL, 列指向, HDFS, Hadoop, BigTable
このWikiは「Open棟梁Project」,「OSSコンソーシアム 開発基盤部会」によって運営されています。