HBase

De wiki.nexiat.fr
Aller à la navigation Aller à la recherche
Fiche express
Domaine Base de données NoSQL orientée colonnes
Repose sur Hadoop (HDFS) + Zookeeper
Inspiré de Google BigTable
Voir aussi Hadoop · Zookeeper · Opentsdb

Apache HBase est une base de données NoSQL orientée colonnes, construite au-dessus de Hadoop (HDFS pour le stockage physique) — c'est l'implémentation open source la plus répandue du modèle décrit dans le papier Google BigTable (2006).

Contrairement à HDFS seul (écriture unique, lecture multiple), HBase apporte des lectures/écritures aléatoires en temps quasi réel sur des tables pouvant compter des milliards de lignes et des millions de colonnes — le cas d'usage typique de Hadoop « brut » (traitement par lots) ne couvre pas ce besoin d'accès ligne par ligne à faible latence.

Positionnement dans l'écosystème

  • Stockage physique délégué à HDFS (Hadoop) — HBase ne gère pas lui-même la
 réplication disque.
  • Coordination du cluster (élection du nœud maître, registre des régions actives) déléguée à
 Zookeeper — HBase ne peut pas démarrer sans un ensemble Zookeeper fonctionnel.
  • Sert souvent de backend de stockage à des outils de séries temporelles à grande échelle,
 comme Opentsdb.

Voir aussi

  • Hadoop — couche de stockage distribué sous-jacente
  • Zookeeper — coordination du cluster HBase
  • Opentsdb — base de séries temporelles construite sur HBase