idea操作Hbase数据库并且映射到Hive
文章目录
- idea操作Hbase数据库并且映射到Hive
- idea操作Hbase数据库
- 环境准备
- 启动服务
- 创建Maven工程
- 在测试类中编写初始化方法
- 在测试类中编写关闭方法
- 在测试类中编写创建命名空间方法
- 在测试类中编写创建表方法
- 在测试类中编写查看表结构方法
- 在测试类中编写插入数据方法
- 在测试类中编写查询数据方法(get)
- 在测试类中编写扫描数据方法(scan)
- 在测试类中编写删除表方法
- Hbase表映射成Hive表
- 创建外部表
- 查询
idea操作Hbase数据库
环境准备
再安装过Hadoop+Hive+zookeeper的实验机上
# 将hbase235/lib/下的jar包拷入到hive312/lib/下
# 如果有重复,选择不覆盖
[root@hadoop conf]# cp /opt/soft/hbase235/lib/* /opt/soft/hive312/lib/
# 将切换到hbase235/lib目录下
[root@hadoop conf]# cd /opt/soft/hbase235/lib/
# 将hive312/lib/guava-27.0-jre.jar复制到当前目录下
[root@hadoop lib]# cp /opt/soft/hive312/lib/guava-27.0-jre.jar ./
# 切换/opt/soft/hive312/conf/目录下
[root@hadoop conf]# cd /opt/soft/hive312/conf/
# 修改 hive-site.xml
[root@hadoop conf]# vim ./hive-site.xml
# 添加配置信息
<property>
<name>hive.zookeeper.quorum</name>
<value>192.168.95.150</value>
</property>
<property>
<name>hbase.zookeeper.quorum</name>
<value>192.168.95.150</value>
</property>
<property>
<name>hive.aux.jars.path</name>
<value>file:///opt/soft/hive312/lib/hive-hbase-handler-3.1.2.jar,file:///opt/soft/hive312/lib/zookeeper-3.4.6.jar,file:///opt/soft/hive312/lib/hbase-client-2.3.5.jar,file:///opt/soft/hive312/lib/hbase-common-2.3.5-tests.jar,file:///opt/soft/hive312/lib/hbase-server-2.3.5.jar,file:///opt/soft/hive312/lib/hbase-common-2.3.5.jar,file:///opt/soft/hive312/lib/hbase-protocol-2.3.5.jar,file:///opt/soft/hive312/lib/htrace-core-3.2.0-incubating.jar</value>
</property>
添加配置
启动服务
# 启动hadoop
[root@hadoop ~]# start-all.sh
# 启动zookeeper
[root@hadoop ~]# zkServer.sh start
# 启动hbase
[root@hadoop ~]# start-hbase.sh
# 启动hive
[root@hadoop ~]# nohup hive --service metastore &
[root@hadoop ~]# nohup hive --service metastore &
创建Maven工程
添加依赖
<dependency>
<groupId>org.apache.hbase</groupId>
<artifactId>hbase-client</artifactId>
<version>2.3.5</version>
</dependency>
<dependency>
<groupId>org.apache.hbase</groupId>
<artifactId>hbase-server</artifactId>
<version>2.3.5</version>
</dependency>
在测试类中编写初始化方法
初始化:添加hbase信息,连接数据库,hbase连接工厂
@Before
public void init() throws IOException {
System.out.println("执行init()方法");
config = HBaseConfiguration.create();
config.set(HConstants.HBASE_DIR,"hdfs://192.168.95.150:9000/hbase");
config.set(HConstants.ZOOKEEPER_QUORUM,"192.168.95.150");
config.set(HConstants.CLIENT_PORT_STR,"2181");
conn = ConnectionFactory.createConnection(config);
admin = conn.getAdmin();
}
在测试类中编写关闭方法
/*
*将连接关闭
*/
@After
public void close() throws IOException {
System.out.println("执行close()方法");
if (admin!=null)
admin.close();
if (conn!=null)
conn.close();
}
在测试类中编写创建命名空间方法
/*
*
* 创建命名空间*/
@Test
public void createNameSpace() throws IOException {
NamespaceDescriptor bigdata = NamespaceDescriptor.create("bigdata").build();
admin.createNamespace(bigdata);
}
在测试类中编写创建表方法
/*
* 创建表
* */
@Test
public void createTable() throws IOException {
//创建表的描述类
TableName tableName = TableName.valueOf("bigdata:student");
HTableDescriptor desc = new HTableDescriptor(tableName);
//创建列族的描述
HColumnDescriptor family1 = new HColumnDescriptor("info1");
HColumnDescriptor family2 = new HColumnDescriptor("info2");
desc.addFamily(family1);
desc.addFamily(family2);
admin.createTable(desc);*/
在测试类中编写查看表结构方法
/*
*查看表结构
*/
@Test
public void getAllNamespace() throws IOException {
List<TableDescriptor> tableDesc = admin.listTableDescriptorsByNamespace("bigdata".getBytes());
System.out.println(tableDesc.toString());
}
在测试类中编写插入数据方法
/*
*
* 插入数据*/
@Test
public void insertData() throws IOException {
Table table = conn.getTable(TableName.valueOf("bigdata:student"));
Put put = new Put(Bytes.toBytes("student1"));
put.addColumn("info1".getBytes(),"name".getBytes(),"zs".getBytes());
put.addColumn("info2".getBytes(),"school".getBytes(),"njzb".getBytes());
Put put2 = new Put(Bytes.toBytes("student2"));
put2.addColumn("info1".getBytes(),"name".getBytes(),"zss".getBytes());
put2.addColumn("info2".getBytes(),"school".getBytes(),"njzb".getBytes());
Put put3 = new Put(Bytes.toBytes("student3"));
put3.addColumn("info1".getBytes(),"name".getBytes(),"zsr".getBytes());
put3.addColumn("info2".getBytes(),"school".getBytes(),"njzb".getBytes());
List<Put> list = new ArrayList<>();
list.add(put1);
list.add(put2);
list.add(put3);
table.put(list);
}
在测试类中编写查询数据方法(get)
/*
* 查询数据 get 查询
* */
@Test
public void queryData() throws IOException {
Table table = conn.getTable(TableName.valueOf("bigdata:student"));
Get get = new Get(Bytes.toBytes("student1"));
Result result = table.get(get);
byte[] value = result.getValue(Bytes.toBytes("info1"), Bytes.toBytes("name"));
System.out.println("姓名:"+Bytes.toString(value));
value = result.getValue(Bytes.toBytes("info2"), Bytes.toBytes("school"));
System.out.println("学校:"+Bytes.toString(value));
}
在测试类中编写扫描数据方法(scan)
/*
* scan 扫描数据
* */
@Test
public void scanData() throws IOException {
Table table = conn.getTable(TableName.valueOf("kb21:student"));
Scan scan = new Scan();
ResultScanner scanner = table.getScanner(scan);
for (Result result : scanner) {
byte[] value = result.getValue(Bytes.toBytes("info1"), Bytes.toBytes("name"));
System.out.println("姓名:"+Bytes.toString(value));
value = result.getValue(Bytes.toBytes("info2"), Bytes.toBytes("school"));
System.out.println("学校:"+Bytes.toString(value));
System.out.println(Bytes.toString(result.getRow()));
}
}
在测试类中编写删除表方法
/*
*删除表
* */
@Test
public void deleteTable() throws IOException {
//先禁用
admin.disableTable(TableName.valueOf("bigdata:student"));
//再删除
admin.deleteTable(TableName.valueOf("bigdata:student"));
}
Hbase表映射成Hive表
使用DataGrip连接Hive
创建外部表
主要外部表的字段需要和Hbase中的列形成映射
create external table student(
id string,
name string,
school string
)
stored by 'org.apache.hadoop.hive.hbase.HBaseStorageHandler' with
serdeproperties ("hbase.columns.mapping"=":key,info1:name,info2:school")
tblproperties ("hbase.table.name"="bigdata:student");
查询
select * from student