首先保证Zookeeper集群的正常部署,并启动之:
[Diao@hadoop120 zookeeper-3.4.10]$ bin/zkServer.sh start
[Diao@hadoop121 zookeeper-3.4.10]$ bin/zkServer.sh start
[Diao@hadoop122 zookeeper-3.4.10]$ bin/zkServer.sh start
Hadoop集群的正常部署并启动:
[Diao@hadoop120 hadoop-2.7.2]$ sbin/start-dfs.sh
[Diao@hadoop121 hadoop-2.7.2]$ sbin/start-yarn.sh
解压Hbase到指定目录:
[Diao@hadoop120 software]$ tar -zxvf hbase-1.3.1-bin.tar.gz -C /opt/module
修改HBase对应的配置文件。
1)hbase-env.sh修改内容:
export JAVA_HOME=/opt/module/jdk1.6.0_144
export HBASE_MANAGES_ZK=false
2)hbase-site.xml修改内容:
hbase.rootdir
hdfs://hadoop120:9000/HBase
hbase.cluster.distributed
true
hbase.master.port
16000
hbase.zookeeper.quorum
hadoop120,hadoop121,hadoop122
hbase.zookeeper.property.dataDir
/opt/module/zookeeper-3.4.10/zkData
3)regionservers:
hadoop120
hadoop121
hadoop122
4)软连接hadoop配置文件到HBase:
[Diao@hadoop120 module]$ ln -s /opt/module/hadoop-2.7.2/etc/hadoop/core-site.xml /opt/module/hbase/conf/core-site.xml
[Diao@hadoop120 module]$ ln -s /opt/module/hadoop-2.7.2/etc/hadoop/hdfs-site.xml /opt/module/hbase/conf/hdfs-site.xml
[Diao@hadoop120 module]$ xsync hbase/
[Diao@hadoop120 hbase]$ bin/hbase-daemon.sh start master
[Diao@hadoop120 hbase]$ bin/hbase-daemon.sh start regionserver
提示:如果集群之间的节点时间不同步,会导致regionserver无法启动,抛出ClockOutOfSyncException异常。
修复提示:
a、同步时间服务
请参看帮助文档:《尚硅谷大数据技术之Hadoop入门》
b、属性:hbase.master.maxclockskew设置更大的值
hbase.master.maxclockskew
180000
Time difference of regionserver from master
[Diao@hadoop120 hbase]$ bin/start-hbase.sh
对应的停止服务:
[Diao@hadoop120 hbase]$ bin/stop-hbase.sh
启动成功后,可以通过“host:port”的方式来访问HBase管理页面,例如:
http://hadoop120:16010
1.进入HBase客户端命令行
[Diao@hadoop120 hbase]$ bin/hbase shell
2.查看帮助命令
hbase(main):001:0> help
3.查看当前数据库中有哪些表
hbase(main):002:0> list
hbase(main):002:0> create 'student','info'
hbase(main):003:0> put 'student','1001','info:sex','male'
hbase(main):004:0> put 'student','1001','info:age','18'
hbase(main):005:0> put 'student','1002','info:name','Janna'
hbase(main):006:0> put 'student','1002','info:sex','female'
hbase(main):007:0> put 'student','1002','info:age','20'
hbase(main):008:0> scan 'student'
hbase(main):009:0> scan 'student',{STARTROW => '1001', STOPROW => '1001'}
hbase(main):010:0> scan 'student',{STARTROW => '1001'}
hbase(main):011:0> describe ‘student’
hbase(main):012:0> put 'student','1001','info:name','Nick'
hbase(main):013:0> put 'student','1001','info:age','100'
hbase(main):014:0> get 'student','1001'
hbase(main):015:0> get 'student','1001','info:name'
hbase(main):021:0> count 'student'
删除某rowkey的全部数据:
hbase(main):016:0> deleteall 'student','1001'
删除某rowkey的某一列数据:
hbase(main):017:0> delete 'student','1002','info:sex'
hbase(main):018:0> truncate 'student'
提示:清空表的操作顺序为先disable,然后再truncate。
首先需要先让该表为disable状态:
hbase(main):019:0> disable 'student'
然后才能drop这个表:
hbase(main):020:0> drop 'student'
提示:如果直接drop表,会报错:ERROR: Table student is enabled. Disable it first.
将info列族中的数据存放3个版本:
hbase(main):022:0> alter 'student',{NAME=>'info',VERSIONS=>3}
hbase(main):022:0> get 'student','1001',{COLUMN=>'info:name',VERSIONS=>3}
API中描述Delate+表名+行键+列族就可以删除指定行键
命令行中需要在列族后面指定列名才能删除指定列
API中描述并没有deleteall命令
命令行中要用deleteall删除指定行键
在列族有多个版本的情况下
API中描述可以删除指定行建最高版本信息
命令行直接删除指定行键的全部版本的信息
原因在于API有两套.但命令行只实现了一套,
所以会发生命令行和API不一样的情况