nifi将hive同步到oracle,NiFi使用总结 一 hive到hive的PutHiveStreaming processor和SelectHiveQL...

我说实话,NiFi的坑真的挺多的。。。

1、PutHiveStreaming processor的使用

该控制器配置需要hive启用事物;且目前只支持orc格式,且建表需要分桶,开启事务等,建表示例如下:

create tabletest_trancaction

(user_id Int,name String)clustered by (user_id) into 3buckets

storedas orc TBLPROPERTIES ('transactional'='true');

hive的事物配置,hive-site.xml配置添加:

hive.support.concurrency

true

hive.enforce.bucketing

true

hive.exec.dynamic.partition.mode

nonstrict

hive.txn.manager

org.apache.hadoop.hive.ql.lockmgr.DbTxnManager

hive.compactor.initiator.on

true

hive.compactor.worker.threads

1

具体配置:

PutHiveStreaming

e4c060d1f18774c9f62106a82bb77b15.png

SelectHiveQL:

双击,进入config配置:

241f2702a1fb09dd2182818a5089cfe0.png

HiveConnectionPool配置:

0fed586cb4d3b3a6f4976d25d22ef095.png

勾选自动终止关系类型:可以都选上

340c598237f5b9b37b3a783e9545479f.png

选择调度策略:

有三种,常用的有time driven,CRON driven

简单测试使用Run Schedule不要用0秒,不然会一直不停的在写入数据。。。

有关调度策略下篇在做具体说明

535287e06687e97202247a4306810c5b.png

运行一下看看:

源数据:

0d77970755cbe77dd6481a2900842691.png

配置好之后右键点击start

887579f69211c0c0e7bc39ffe4b12495.png

过一分钟左右查看插入数据:

c7be92c065083d0077a99b4e79b75ec1.png

条数有可能不止14条,后续再研究调度的程序设置;

到此为止简单实现了hive-hive的配置

  • 0
    点赞
  • 0
    收藏
    觉得还不错? 一键收藏
  • 0
    评论

“相关推荐”对你有帮助么?

  • 非常没帮助
  • 没帮助
  • 一般
  • 有帮助
  • 非常有帮助
提交
评论
添加红包

请填写红包祝福语或标题

红包个数最小为10个

红包金额最低5元

当前余额3.43前往充值 >
需支付:10.00
成就一亿技术人!
领取后你会自动成为博主和红包主的粉丝 规则
hope_wisdom
发出的红包
实付
使用余额支付
点击重新获取
扫码支付
钱包余额 0

抵扣说明:

1.余额是钱包充值的虚拟货币,按照1:1的比例进行支付金额的抵扣。
2.余额无法直接购买下载,可以购买VIP、付费专栏及课程。

余额充值