Hive函数

最新推荐文章于 2021-12-02 12:00:00 发布

qq_24990561

最新推荐文章于 2021-12-02 12:00:00 发布

阅读量87

点赞数

分类专栏：技术文章标签： HIVE 函数

本文链接：https://blog.csdn.net/qq_24990561/article/details/86651996

版权

技术专栏收录该内容

41 篇文章 0 订阅

订阅专栏

系统自定义的函数

1)查看系统自带的函数

 hive> show functions;

2)显示自带的函数的用法

hive> desc function upper;

3)详细显示自带的函数的用法

hive> desc function extended upper;

自定义函数

1)Hive 自带了一些函数，比如:max/min 等，但是数量有限，自己可以通过自定义 UDF 来方便的扩展。
2)当 Hive 提供的内置函数无法满足你的业务处理需要时，此时就可以考虑使用用户自定义函数(UDF:user-defined function)。
3)根据用户自定义函数类别分为以下三种:
(1)UDF(User-Defined-Function)
一进一出
2)UDAF(User-Defined Aggregation Function) 聚集函数，多进一出
类似于:count/max/min
(3)UDTF(User-Defined Table-Generating Functions) 一进多出
如 lateral view explore()
4)编程步骤:
(1)继承 org.apache.hadoop.hive.ql.UDF (2)需要实现 evaluate 函数;evaluate 函数支持重载; (3)在 hive 的命令行窗口创建函数
a)添加 jar
add jar linux_jar_path
b)创建 function，
create [temporary] function [dbname.]function_name AS class_name;
(4)在 hive 的命令行窗口删除函数
Drop [temporary] function [if exists] [dbname.]function_name;
5)注意事项
UDF 必须要有返回类型，可以返回 null，但是返回类型不能为 void;

3 自定义UDF函数开发案例

1)创建一个 java 工程，并创建一个 lib 文件夹
2)将 hive 的 jar 包解压后，将 apache-hive-1.2.1-bin\lib 文件下的 jar 包都拷贝到 java 工程中。
3)创建一个类

import org.apache.hadoop.hive.ql.exec.UDF;
public class Lower extends UDF {
public String evaluate (final String s) {if (s == null) { return null;
}
return s.toString().toLowerCase(); }
}
4)打成 jar 包上传到服务器/opt/module/jars/udf.jar 5)将 jar 包添加到 hive 的 classpath

hive (default)> add jar /opt/module/datas/udf.jar;
6)创建临时函数与开发好的 java class 关联
hive (default)> create temporary function my_lower as “com.atguigu.hive.Lower”;
7)即可在 hql 中使用自定义的函数 strip
hive (default)> select ename, my_lower(ename) lowername from emp;
以上方法是比较基础的，初步的UDF,还有一种是从源码角度来定义UDF!!

qq_24990561

关注

0
点赞
踩
0

收藏

觉得还不错? 一键收藏
0
评论
Hive函数

1系统自定义的函数1)查看系统自带的函数 hive&gt; show functions;2)显示自带的函数的用法hive&gt; desc function upper;3)详细显示自带的函数的用法hive&gt; desc function extended upper;自定义函数1)Hive 自带了一些函数，比如:max/min 等，但是数量有限，自己可以通过...
复制链接

扫一扫

专栏目录