HBase
Aller à la navigation
Aller à la recherche
| Fiche express | |
|---|---|
| Domaine | Base de données NoSQL orientée colonnes |
| Repose sur | Hadoop (HDFS) + Zookeeper |
| Inspiré de | Google BigTable |
| Voir aussi | Hadoop · Zookeeper · Opentsdb |
Apache HBase est une base de données NoSQL orientée colonnes, construite au-dessus de Hadoop (HDFS pour le stockage physique) — c'est l'implémentation open source la plus répandue du modèle décrit dans le papier Google BigTable (2006).
Contrairement à HDFS seul (écriture unique, lecture multiple), HBase apporte des lectures/écritures aléatoires en temps quasi réel sur des tables pouvant compter des milliards de lignes et des millions de colonnes — le cas d'usage typique de Hadoop « brut » (traitement par lots) ne couvre pas ce besoin d'accès ligne par ligne à faible latence.
Positionnement dans l'écosystème
- Stockage physique délégué à HDFS (Hadoop) — HBase ne gère pas lui-même la
réplication disque.
- Coordination du cluster (élection du nœud maître, registre des régions actives) déléguée à
Zookeeper — HBase ne peut pas démarrer sans un ensemble Zookeeper fonctionnel.
- Sert souvent de backend de stockage à des outils de séries temporelles à grande échelle,
comme Opentsdb.