1 查看hive中的变量
查看hive启动后加载的所有的变量
set
查看某个指定的参数的值
set 属性名
对加载的参数进行修改,此次修改只有当前的cli有效,一旦退出就需要重新设置
set 属性名=属性值;
使用hive -d 变量名=变量值,启动后,可以在cli使用 **${变量名}**引用变量名,获取它的值!
2.hive交互命令
hive
-d key=value: 定义一个变量名=变量值
--database 库名: 让hive初始化连接指定的库
-e <quoted-query-string> : hive读取命令行的sql语句执行,结束后退出cli
-f sql文件: hive读取文件中的sql语句执行,结束后退出cli
--hivevar <key=value> : 等价于-d
--hiveconf <property=value>: 在启动hive时,定义hive中的某个属性设置为指定的值
-i <filename> : 在启动hive后,先初始化地执行指定文件中的sql,不退出cli
-S,--silent : 静默模式,不输出和结果无关的信息
3 hive中属性加载的顺序
a)hive依赖于hadoop,hive启动时,默认会读取Hadoop的8个配置文件
b)加载hive默认的配置文件hive-default.xml
c)加载用户自定义的hive-site.xml
d)如果用户在输入hive命令时,指定了–hiveconf,那么用户指定的参数会覆盖之前已经读取的同名的参数!
4 在cli中使用其他命令
访问hdfs
dfs 命令
运行shell中的命令
!命令
5 数据类型
5.1 基本数据类型
Hive数据类型 | Java数据类型 | 长度 | 例子 |
---|---|---|---|
TINYINT | byte | 1byte有符号整数 | 20 |
SMALINT | short | 2byte有符号整数 | 20 |
INT | int | 4byte有符号整数 | 20 |
BIGINT | long | 8byte有符号整数 | 20 |
BOOLEAN | boolean | 布尔类型,true或者false | TRUE FALSE |
FLOAT | float | 单精度浮点数 | 3.14159 |
DOUBLE | double | 双精度浮点数 | 3.14159 |
STRING | string | 字符系列。可以指定字符集。可以使用单引号或者双引号。 | ‘now is the time’ “for all good men” |
TIMESTAMP | 时间类型 | ||
BINARY | 字节数组 |
对于Hive的String类型相当于数据库的varchar类型,该类型是一个可变的字符串,不过它不能声明其中最多能存储多少个字符,理论上它可以存储2GB的字符数。
5.2 集合数据类型
数据类型 | 描述 | 语法示例 |
---|---|---|
*STRUCT* | 和c语言中的struct类似,都可以通过“点”符号访问元素内容。例如,如果某个列的数据类型是STRUCT{first STRING, last STRING},那么第1个元素可以通过字段.first来引用。 | struct() |
MAP | MAP是一组键-值对元组集合,使用数组表示法可以访问数据。例如,如果某个列的数据类型是MAP,其中键->值对是’first’->’John’和’last’->’Doe’,那么可以通过字段名[‘last’]获取最后一个元素 | map() |
ARRAY | 数组是一组具有相同类型和名称的变量的集合。这些变量称为数组的元素,每个数组元素都有一个编号,编号从零开始。例如,数组值为[‘John’, ‘Doe’],那么第2个元素可以通过数组名[1]进行引用。 | Array() |
Hive有三种复杂数据类型ARRAY、MAP 和 STRUCT。ARRAY和MAP与Java中的Array和Map类似,而STRUCT与C语言中的Struct类似,它封装了一个命名字段集合,复杂数据类型允许任意层次的嵌套。
5.3 类型转换
任何低精度类型在和高精度类型运算时,可以自动向上转型!
布尔类型无法转为其他类型!
使用强制类型转换:
cast('值' as 类型)
如果强转失败,则为NULL!