HBase
 sql >> Datenbank >  >> NoSQL >> HBase

töten zombie tote regionserver

Ich hatte dieses dn24 RegionServer wurde in HBaseUI als tot markiert, aber diese Maschine wurde vor Monaten stillgelegt und aus dem Cluster entfernt.

Nach einigem Graben scheint es, dass es hier steht, weil es von HBase immer noch als „aktiv“ angesehen wurde und der Grund dafür in HDFS gefunden wurde:

[root@machine ~]# hdfs dfs -ls /apps/hbase/data/WALs/

drwxrwx--- - hbase hdfs 0 2015-11-08 00:33 /apps/hbase/data/WALs/dn17.test.fr,60020,1446939183416
drwxrwx--- - hbase hdfs 0 2015-11-08 00:33 /apps/hbase/data/WALs/dn18.test.fr,60020,1446939179122
drwxrwx--- - hbase hdfs 0 2015-11-08 00:33 /apps/hbase/data/WALs/dn19.test.fr,60020,1446939182213
drwxrwx--- - hbase hdfs 0 2015-11-08 00:33 /apps/hbase/data/WALs/dn20.test.fr,60020,1446939182925
drwxrwx--- - hbase hdfs 0 2015-11-08 00:33 /apps/hbase/data/WALs/dn21.test.fr,60020,1446939185744
drwxrwx--- - hbase hdfs 0 2015-11-08 00:33 /apps/hbase/data/WALs/dn22.test.fr,60020,1446939173931
drwxrwx--- - hbase hdfs 0 2015-11-08 00:33 /apps/hbase/data/WALs/dn24.test.fr,60020,1409665198801-splitting
drwxrwx--- - hbase hdfs 0 2015-11-08 00:33 /apps/hbase/data/WALs/dn25.test.fr,60020,1446939185856
drwxrwx--- - hbase hdfs 0 2015-11-08 00:33 /apps/hbase/data/WALs/dn26.test.fr,60020,1446939178831
drwxrwx--- - hbase hdfs 0 2015-11-08 00:33 /apps/hbase/data/WALs/dn27.test.fr,60020,1446939183921
drwxrwx--- - hbase hdfs 0 2015-11-08 00:33 /apps/hbase/data/WALs/dn28.test.fr,60020,1446939179838
drwxrwx--- - hbase hdfs 0 2015-11-08 00:33 /apps/hbase/data/WALs/dn29.test.fr,60020,1446939178499

 

Gefunden ? Das WAL (Write-Ahead-Protokoll ) befand sich noch in HDFS im Zustand „Splitting“, also ist es aus HBase-Perspektive nicht tot.

Ich habe das dn24 WAL-Verzeichnis in HDFS entfernt, HBaseMaster neu gestartet (keine Ausfallzeit auf HBase beim Neustart von HBaseMaster), es ist verschwunden.