【hive】hive的简单使用

在hive配好了之后:

hive的启动:输入"hive"就能启动了。

1,数据的显示

show databases;  --------能够显示当前的hive拥有的数据库;

use database_name;----------使用这个数据库;

show tables;--------能够展示当前数据库中拥有的数据表;

show tables in database_name;---------显示数据库下的数据表名;

describe/desc [extended/formatted]  database_name.table_name; ---------显示数据表的字段信息;[]中的选项可以显示详细以及更详细的信息。

show partitions  query_goods_feature;-------显示在建库时命名的partition的字段信息。

 

2,join

jion操作是将两个及以上的表连接起来,根据不同的情况join分成:join,left outer join,right outer join,full out join。

以如下两张表为基础:

customers:

+----+----------+-----+-----------+----------+ 
| ID | NAME     | AGE | ADDRESS   | SALARY   | 
+----+----------+-----+-----------+----------+ 
| 1  | Ramesh   | 32  | Ahmedabad | 2000.00  |  
| 2  | Khilan   | 25  | Delhi     | 1500.00  |  
| 3  | kaushik  | 23  | Kota      | 2000.00  | 
| 4  | Chaitali | 25  | Mumbai    | 6500.00  | 
| 5  | Hardik   | 27  | Bhopal    | 8500.00  | 
| 6  | Komal    | 22  | MP        | 4500.00  | 
| 7  | Muffy    | 24  | Indore    | 10000.00 | 
+----+----------+-----+-----------+----------+

orders:

+-----+---------------------+-------------+--------+ 
|OID  | DATE                | CUSTOMER_ID | AMOUNT | 
+-----+---------------------+-------------+--------+ 
| 102 | 2009-10-08 00:00:00 |           3 | 3000   | 
| 100 | 2009-10-08 00:00:00 |           3 | 1500   | 
| 101 | 2009-11-20 00:00:00 |           2 | 1560   | 
| 103 | 2008-05-20 00:00:00 |           4 | 2060   | 
+-----+---------------------+-------------+--------+

两张表通过customers.id 和 orders.customer_id来连接,下面讨论不同join方式得到的结果。

2.1,join,就是内连接,如果只输出满足条件的数据。

SELECT c.ID, c.NAME, c.AGE, o.AMOUNT 
 FROM CUSTOMERS c JOIN ORDERS o  ON (c.ID = o.CUSTOMER_ID);

得到的结果如下:

+----+----------+-----+--------+ 
| ID | NAME     | AGE | AMOUNT | 
+----+----------+-----+--------+ 
| 3  | kaushik  | 23  | 3000   | 
| 3  | kaushik  | 23  | 1500   | 
| 2  | Khilan   | 25  | 1560   | 
| 4  | Chaitali | 25  | 2060   | 
+----+----------+-----+--------+

2.2,left outer join,左连接,连接的左表要全部都输出,不满足条件的左表数据用NULL代替:

 SELECT c.ID, c.NAME, o.AMOUNT, o.DATE 
 FROM CUSTOMERS c LEFT OUTER JOIN ORDERS o 
 ON (c.ID = o.CUSTOMER_ID);

结果如下所示:

+----+----------+--------+---------------------+ 
| ID | NAME     | AMOUNT | DATE                | 
+----+----------+--------+---------------------+ 
| 1  | Ramesh   | NULL   | NULL                | 
| 2  | Khilan   | 1560   | 2009-11-20 00:00:00 | 
| 3  | kaushik  | 3000   | 2009-10-08 00:00:00 | 
| 3  | kaushik  | 1500   | 2009-10-08 00:00:00 | 
| 4  | Chaitali | 2060   | 2008-05-20 00:00:00 | 
| 5  | Hardik   | NULL   | NULL                | 
| 6  | Komal    | NULL   | NULL                | 
| 7  | Muffy    | NULL   | NULL                | 
+----+----------+--------+---------------------+

2.3,right outer join,右连接,连接的右表要全部都输出,不满足条件的右表数据用NULL代替:

该部分的与“left outer join,左连接”相似,略过。

2.4,full outer join,全连接,需要连接的两张表的数据全部都输出。其本质上是先对数据进行左连接,然后再对数据进行右连接,再将结果连接起来。

SELECT c.ID, c.NAME, o.AMOUNT, o.DATE 
FROM CUSTOMERS c 
FULL OUTER JOIN ORDERS o ON (c.ID = o.CUSTOMER_ID);

结果为:

+------+----------+--------+---------------------+ 
| ID   | NAME     | AMOUNT | DATE                | 
+------+----------+--------+---------------------+ 
| 1    | Ramesh   | NULL   | NULL                | 
| 2    | Khilan   | 1560   | 2009-11-20 00:00:00 | 
| 3    | kaushik  | 3000   | 2009-10-08 00:00:00 | 
| 3    | kaushik  | 1500   | 2009-10-08 00:00:00 | 
| 4    | Chaitali | 2060   | 2008-05-20 00:00:00 | 
| 5    | Hardik   | NULL   | NULL                | 
| 6    | Komal    | NULL   | NULL                |
| 7    | Muffy    | NULL   | NULL                |  
| 3    | kaushik  | 3000   | 2009-10-08 00:00:00 | 
| 3    | kaushik  | 1500   | 2009-10-08 00:00:00 | 
| 2    | Khilan   | 1560   | 2009-11-20 00:00:00 | 
| 4    | Chaitali | 2060   | 2008-05-20 00:00:00 | 
+------+----------+--------+---------------------+

对于不在一个数据库的数据表也可以一起join:

select memuid.uid,search.query  from (select 
search_view.member_id,search_view.query as query from search_mengtui.search_view where day > "2019-05-24") 
search join   (select uid_h_map.uid_h as
 uid_h,uid_h_map.uid as uid from src_mengtui.uid_h_map) 
memuid on search.member_id = memuid.uid_h

在search_view表中得到memberid和query,在uid_h_map中得到uid和memberid,然后join用memberid和作为连接,最后输出uid和query。

3,查看最早或者最晚时间

select max(day) from search_mengtui.query_goods_feature ;
select min(day) from search_mengtui.query_goods_feature ;

可以通过对某个字段的max和min来查看该字段的最早和最晚时间。结果如下所示:

+-------------+
|     _c0     |
+-------------+
| 2019-07-20  |
+-------------+

 

  • 0
    点赞
  • 0
    收藏
    觉得还不错? 一键收藏
  • 打赏
    打赏
  • 0
    评论
评论
添加红包

请填写红包祝福语或标题

红包个数最小为10个

红包金额最低5元

当前余额3.43前往充值 >
需支付:10.00
成就一亿技术人!
领取后你会自动成为博主和红包主的粉丝 规则
hope_wisdom
发出的红包

打赏作者

一杯拿铁go

你的打赏是我更新最大的动力

¥1 ¥2 ¥4 ¥6 ¥10 ¥20
扫码支付:¥1
获取中
扫码支付

您的余额不足,请更换扫码支付或充值

打赏作者

实付
使用余额支付
点击重新获取
扫码支付
钱包余额 0

抵扣说明:

1.余额是钱包充值的虚拟货币,按照1:1的比例进行支付金额的抵扣。
2.余额无法直接购买下载,可以购买VIP、付费专栏及课程。

余额充值