CDH中安装StreamSets

StreamSets 安装部署

  1. StreamSets 简介

    StreamSets由Informatica前首席产品官Girish Pancha和Cloudera前开发团队负责人Arvind Prabhakar于2014年创立。他们成立该公司主要是应对来自动态数据(data in motion)的挑战 - 包括数据源,数据处理和数据本身,这是一个称为“数据漂移“(https://streamsets.com/reports/data-drift/)的问题。StreamSets设想从头开始管理数据流,避免已有产品和工具的缺陷,并启用一种管理动态数据(data in motion)的新方法。

    最新的产品StreamSets Dataflow Performance Manager,也叫DPM,主要用于构建端到端的数据流。DPM是一个运行控制中心,可以让你映射(数据流),内置的测量和监测确保持续的数据传输和控制动态数据(data in motion)的性能。首先,它将你不同的数据流映射到支持你的每个关键业务流程的拓扑中。然后监测这些拓扑的日常运行情况,根据掌握的性能情况,以满足应用的SLA为目标,确保你始终提供及时和可信的数据。

  2. 下载StreamSets安装包
    下载地址:https://archives.streamsets.com/index.html 在这里插入图片描述

  3. 配置本地Parcel包

    yum -y install httpd
    
    systemctl start httpd
    
    chkconfig httpd on 
    
    mkdir -p /var/www/html/streamsets
    
    mv manifest.json /var/www/html/streamset/
    
    mv STREAMSETS_DATACOLLECTOR-3.3.0-el7.parcel /var/www/html/streamset/
    

    在这里插入图片描述

  4. 配置CSD

将STREAMSETS-3.0.0.0.jar拷贝到/opt/cloudera/csd,并更改权限,然后重启cloudera-scm-server服务

[root@hadoop01 ~]# cp STREAMSETS-3.0.0.0.jar /opt/cloudera/csd
[root@hadoop01 csd]# sudo chown cloudera-scm:cloudera-scm STREAMSETS-3.0.0.0.jar && sudo chmod 644 STREAMSETS-3.0.0.0.jar
[root@hadoop01 ~]# /opt/cm-5.11.0/etc/init.d/cloudera-scm-server restart

1551169260148

  1. 下载分发激活StreamSets 包

在CM界面中点击Parcel > 配置 > 添加StreamSets的Parcel包路径,并保持修改

在这里插入图片描述
在这里插入图片描述

在这里插入图片描述

在这里插入图片描述
![1551169932163](C:\Users\admin\AppData\Roaming\Typora\typora-user-images)
在这里插入图片描述
在这里插入图片描述
1551170266622在这里插入图片描述
在这里插入图片描述
6. 添加StreamSets服务
在这里插入图片描述在这里插入图片描述

在这里插入图片描述
在这里插入图片描述
在这里插入图片描述
在这里插入图片描述
在这里插入图片描述

在这里插入图片描述
在这里插入图片描述

在这里插入图片描述
在这里插入图片描述
在这里插入图片描述

  • 0
    点赞
  • 1
    收藏
    觉得还不错? 一键收藏
  • 0
    评论

“相关推荐”对你有帮助么?

  • 非常没帮助
  • 没帮助
  • 一般
  • 有帮助
  • 非常有帮助
提交
评论
添加红包

请填写红包祝福语或标题

红包个数最小为10个

红包金额最低5元

当前余额3.43前往充值 >
需支付:10.00
成就一亿技术人!
领取后你会自动成为博主和红包主的粉丝 规则
hope_wisdom
发出的红包
实付
使用余额支付
点击重新获取
扫码支付
钱包余额 0

抵扣说明:

1.余额是钱包充值的虚拟货币,按照1:1的比例进行支付金额的抵扣。
2.余额无法直接购买下载,可以购买VIP、付费专栏及课程。

余额充值