Hive创建UDTF函数

最新推荐文章于 2023-04-23 11:42:44 发布

xxydzyr

最新推荐文章于 2023-04-23 11:42:44 发布

阅读量348

点赞数

分类专栏：从零开始Hadoop Hadoop 文章标签： Hadoop Hive

原文链接：https://blog.csdn.net/xiaofengguojiangnan/article/details/80059703

版权

从零开始Hadoop 同时被 3 个专栏收录

57 篇文章 3 订阅

订阅专栏

Hadoop

43 篇文章 0 订阅

订阅专栏

#Hive

13 篇文章 0 订阅

订阅专栏

Hive创建UDTF函数

文章目录

- Hive创建UDTF函数
- - 参考：

这部分不知道建一个什么样的函数，就照着网上的来了，所以就不写其他东西了

package com.chinasofti.hive.udf;

import org.apache.hadoop.hive.ql.exec.UDFArgumentException;
import org.apache.hadoop.hive.ql.exec.UDFArgumentLengthException;
import org.apache.hadoop.hive.ql.metadata.HiveException;
import org.apache.hadoop.hive.ql.udf.generic.GenericUDTF;
import org.apache.hadoop.hive.serde2.objectinspector.ObjectInspector;
import org.apache.hadoop.hive.serde2.objectinspector.ObjectInspectorFactory;
import org.apache.hadoop.hive.serde2.objectinspector.StructObjectInspector;
import org.apache.hadoop.hive.serde2.objectinspector.primitive.PrimitiveObjectInspectorFactory;

import java.util.ArrayList;

// 继承 GenericUDTF 类，需要实现 process 和 close 方法，然后还需要自己重写 initialize 方法
public class TestUDTF extends GenericUDTF {

    //
    @Override
    public StructObjectInspector initialize(ObjectInspector[] args)
            throws UDFArgumentException {
        if (args.length != 1) {
            throw new UDFArgumentLengthException("ExplodeMap takes only one argument");
        }
        if (args[0].getCategory() != ObjectInspector.Category.PRIMITIVE) {
            throw new UDFArgumentException("ExplodeMap takes string as a parameter");
        }

        ArrayList<String> fieldNames = new ArrayList<String>();
        ArrayList<ObjectInspector> fieldOIs = new ArrayList<ObjectInspector>();
        fieldNames.add("col1");
        fieldOIs.add(PrimitiveObjectInspectorFactory.javaStringObjectInspector);
        fieldNames.add("col2");
        fieldOIs.add(PrimitiveObjectInspectorFactory.javaStringObjectInspector);

        return ObjectInspectorFactory.getStandardStructObjectInspector(fieldNames,fieldOIs);
    }

    public void process(Object[] args) throws HiveException {
        String input = args[0].toString();
        String[] test = input.split(";");
        for(int i=0; i<test.length; i++) {
            try {
                String[] result = test[i].split(":");
                forward(result);
            } catch (Exception e) {
                continue;
            }
        }
    }

    public void close() throws HiveException {

    }
}