Hive高级查询

本文详细介绍了Hive的高级查询,包括基本查询、WHERE过滤、GROUP BY分组、CTE和嵌套查询、JOIN操作、集合操作及排序。内容涵盖全表和特定字段查询、列别名、LIMIT语句、WHERE子句的各种运算符,以及GROUP BY与HAVING的区别。此外,还讲解了CTE的概念和示例,各种类型的JOIN(内连接、外连接、全连接)以及MapJoin的使用场景。最后,讨论了Hive的并集、交集、差集操作,以及ORDER BY、SORT BY、DISTRIBUTE BY和CLUSTER BY的排序和分区功能。
摘要由CSDN通过智能技术生成

基本查询

1.全表和特定字段查询
(1)全表查询

hive (default)> select * from emp;

(2)特定字段查询

hive (default)> select empno, ename from emp;

(3)注意:
①SQL 语言大小写不敏感
②SQL 可以写在一行或者多行
③关键字不能被缩写也不能分行
④各子句一般要分行写(不分行写不会报错,但影响阅读)
⑤使用缩进提高语句的可读性

2.列别名
和 MySQL 一样,我们同样可以通过列别名重命名一个列,以便于计算。列别名可以紧跟列名,也可以在列名和别名之间加入关键字‘AS’。

hive (default)> select ename AS name, deptno dn from emp;

3.算术运算符
示例:

hive (default)> select sal +1 from emp;

4.LIMIT 语句
典型的查询会返回多行数据。LIMIT 子句用于限制返回的行数。
示例:

hive (default)> select * from emp limit 5;

WHERE查询

可以使用 WHERE 子句,将不满足条件的行过滤掉,WHERE 子句紧随 FROM 子句
示例:

--查询出薪水大于 1000 的所有员工
hive (default)> select * from emp where sal >1000;

1.比较运算符(BETWEEN/IN/ IS NULL)
(1)between
表示范围在两者之间,通常和and连用

--查询工资在 500 到 1000 的员工信息
hive (default)> select * from emp where sal between 500 and 1000;

(2)=
等于某个数值或者字段

--查询出薪水等于 5000 的所有员工
hive (default)> select * from emp where sal =5000;

(3)is null
表示为空

--查询 comm 为空的所有员工信息
hive (default)> select * from emp where comm is null;

(4)in
表示范围

--查询工资是 1500 和 5000 的员工信息
hive (default)> select * from emp where sal IN (1500, 5000);

2.like和rlike
(1)like
可以使用 LIKE 运算选择类似的值,选择条件可以包含字符或数字:
①% 代表零个或多个字符(任意个字符)。

  • 0
    点赞
  • 0
    收藏
    觉得还不错? 一键收藏
  • 0
    评论
评论
添加红包

请填写红包祝福语或标题

红包个数最小为10个

红包金额最低5元

当前余额3.43前往充值 >
需支付:10.00
成就一亿技术人!
领取后你会自动成为博主和红包主的粉丝 规则
hope_wisdom
发出的红包
实付
使用余额支付
点击重新获取
扫码支付
钱包余额 0

抵扣说明:

1.余额是钱包充值的虚拟货币,按照1:1的比例进行支付金额的抵扣。
2.余额无法直接购买下载,可以购买VIP、付费专栏及课程。

余额充值