kettle调度监控平台(kettle-scheduler)开源

  • 背景

Kettle作为用户规模最多的开源ETL工具,强大简洁的功能深受广大ETL从业者的欢迎。但kettle本身的调度监控功能却非常弱。Pentaho官方都建议采用crontab(Unix平台)和计划任务(Windows平台)来完成调度功能。所以大家在实施kettle作业调度功能的时候,通常采用以下几种方式:使用spoon程序来启动Job,使用crontab或计划任务,自主开发java程序来调用kettle的类库。

  • 项目介绍

Kettle调度监控平台(以下简称KS)是一个自主开发的javaweb程序,专门用来调度和监控由kettle客户端创建的job和transformation。KS整体的框架是由spring+sprin gmvc +beetlsql整合而成,通过调用kettle的API来执行转换和作业,并且使用quartz框架完成调度工作。

此版本基于kettle-8.0.0.0-28版本的API开发的,目前可以基本支持所有的组件,包括大数据组件(hbase、hive、hdfs等)。

项目源码:GitHub - zhaxiaodong9860/kettle-scheduler: 一款简单易用的Kettle调度监控平台,专门用来调度和监控由kettle客户端创建的job和transformation。整体的框架是由spring+sprin gmvc +beetlsql整合而成,通过调用kettle的API来执行转换和作业,并且使用quartz框架完成调度工作。(不要忘了给个star哦)

发布版本:百度网盘 请输入提取码 提取码 提取码: 52r8 

kettle8.0工具下载地址:点击下载

  • 部署

1.基础环境

         操作系统:windows(linux类似)

         预装软件:jdk1.8、mysql、tomcat、kettle8.0

2.将源码中kettle-scheduler.sql导入mysql数据库。

3.将源码编译打包后解压到tomcat下的webapps目录下。

4.配置km\WEB-INF\classes\resource\db.properties

jdbc.driver=com.mysql.jdbc.Driver   //mysql驱动
jdbc.url=jdbc:mysql://192.22.107.97:3306/kettle-master?serverTimezone=UTC&characterEncoding=utf8&useUnicode=true&useSSL=false   //mysql的jdbc url
jdbc.username=root  //mysql用户名
jdbc.password=123456   //mysql密码

5.配置km\WEB-INF\classes\resource\ kettle.properties

# Kettle Properties  
#绝对路径,用于初始化kettle环境变量(.kettle/kettle.properties所在路径),指向kettle根目录(例如 D:\data-integration)
kettle.home=D:\\data-integration
#绝对路径kettle下plugins文件
kettle.plugin=E:\\zhaxiaodong\\apache-tomcat-9.0.12\\bin\\plugins
#相对路径,不需要改,暂时没有查出有什么用
kettle.script=Html\\js\\libs\\url
#日志级别
kettle.loglevel=detail
#kettle日志存放路径
kettle.log.file.path=D:\\data-integration\\logs
#保存上传文件转换(.ktr)或作业(.kjb)的路径,此功能未调试,暂时停用,待开发
kettle.file.repository=D:\\data-integration\\test

6.需要用到大数据组件的:将data-integration目录下的simple-jndi、system和plugins文件夹拷贝到apache-tomcat-9.0.12\bin目录下

不需要用到大数据组件的:将kettle-scheduler/src/main/resources目录下kettle-lifecycle-listeners.xmlkettle-registry-extensions.xml删除。

7.启动tomcat

          Windows:apache-tomcat-9.0.12\bin\startup.bat;

                      Linux: apache-tomcat-9.0.12\bin\startup.sh;

8.访问http://localhost:8080/km进入系统。注意:km为解压到tomcat/webapps下的项目的文件夹名称,一般源码编译后为kettle-scheduler,即可访问http://localhost:8080/kettle-scheduler。localhost为部署的服务器IP。

  • 使用说明

1.登陆

        访问http://localhost:8080/km进入登陆界面,用户名admin,密码admin

2.首页

首页主要是显示监控信息,当一个任务(作业或转换)启动后,这个任务就处于被系统的监控状态下,首页展示了总监控任务数、监控作业数、监控转换数、转换监控记录(仅显示5条)、作业监控记录(仅显示5条)以及7天内作业和转换的监控状况。

 

3.资源库管理

管理kettle数据库资源库的信息,可以新增、修改、删除数据库资源库。

4.任务管理 – 作业管理

管理作业定时任务,可以新增、修改、删除作业定时任务,启动后作业即开始运行。

5.任务管理 – 转换管理

管理转换定时任务,可以新增、修改、删除转换定时任务,启动后转换即开始运行。

6.任务管理 – 执行策略

管理执行策略,可以新增、修改、删除执行策略(定时执行策略)。

7.监控管理 – 作业监控

处于运行的作业会被系统监控,此处显示被监控的作业的监控信息,包括总作业任务数、总执行成功次数、总执行失败次数以及每个作业的成功次数和失败次数。查看详情页面还可以查看每次执行的日志及执行时间,日志还可下载。

8.监控管理 – 转换监控

处于运行的转换会被系统监控,此处显示被监控的转换的监控信息,包括总转换任务数、总执行成功次数、总执行失败次数以及每个转换的成功次数和失败次数。查看详情页面还可以查看每次执行的日志及执行时间,日志还可下载。

9.用户管理

此菜单只有admin用户登陆时显示,用户管理用户,admin用户可以新增用户、编辑用户、删除用户。

最后希望大家可以一起维护此项目,如有问题可加入qq群提问

点击链接加入群聊

【kettle-scheduler交流QQ群:817362677(已满)】

【kettle-scheduler交流QQ群2:821614032(已满)】

【kettle-scheduler交流QQ群3:553956378(已满)】

【kettle-scheduler交流群4:881730283】

  • 36
    点赞
  • 214
    收藏
    觉得还不错? 一键收藏
  • 39
    评论
Apache DolphinScheduler是一个新一代分布式大数据工作流任务调度系统,致力于“解决大数据任务之间错综复杂的依赖关系,整个数据处理开箱即用”。它以 DAG(有向无环图) 的方式将任务连接起来,可实时监控任务的运行状态,同时支持重试、从指定节点恢复失败、暂停及 Kill任务等操作。目前已经有像IBM、腾讯、美团、360等400多家公司生产上使用。 调度系统现在市面上的调度系统那么多,比如老牌的Airflow, Oozie,Kettle,xxl-job ,Spring Batch等等, 为什么要选DolphinScheduler ? DolphinScheduler 的定位是大数据工作流调度。通过把大数据和工作流做了重点标注. 从而可以知道DolphinScheduler的定位是针对于大数据体系。DolphinScheduler 发展很快 很多公司调度都切换到了DolphinScheduler,掌握DolphinScheduler调度使用势在必行,抓住新技术机遇,为跳巢涨薪做好准备。 优秀的框架都是有大师级别的人写出来的,包含了很多设计思想和技术。DolphinScheduler也不例外,它是一个非常优秀的框架,用到很多技术和设计思想,本课程会带大家深入DolphinScheduler框架源码,包括设计的思想和技术都会讲解,DolphinScheduler源码很多,会按照模块进行讲解,学习完课程后,不仅可以熟悉DolphinScheduler使用,而且可以掌握很多优秀的设计思想和技术,给自己的技术带来很大提升,为跳巢涨薪做好准备。
kettle9是一个数据集成和ETL工具,由Kettle项目开发而来。它提供了可视化的界面,使用户能够通过简单的拖拽和配置来设计数据转换和处理的工作流程。Kettle9支持多种类型的数据源,包括关系型数据库、文件、Web服务等,可以方便地对数据进行抽取、清洗、转换和加载等操作。 而kettle-scheduler是基于Kettle9的调度器组件,它提供了一套功能丰富的调度管理和监控机制,可以用于定时执行和控制Kettle9的作业和转换任务。通过kettle-scheduler,用户可以灵活地设置作业的运行时间、频率和触发条件,也可以监控作业的执行状态和运行日志。 kettle-scheduler的核心功能包括以下几个方面: 1. 作业调度管理:kettle-scheduler可以根据用户的需求,设置和管理Kettle9作业的调度计划,包括作业的触发时间、频率、依赖关系等。用户可以设定一次性的任务,也可以设置周期性的任务,以满足不同的业务需求。 2. 作业监控和报警:kettle-scheduler可以实时监控作业的执行状态和运行日志,当作业运行出现异常或错误时,可以及时发送报警通知给相关人员,以便及时处理和修复。 3. 作业并发控制:kettle-scheduler可以设置作业的并发执行数量,以控制任务的同时运行数量,避免资源的过度占用和冲突。 总之,kettle9和kettle-scheduler是一套强大的数据集成和调度管理工具,能够帮助用户更高效、灵活地处理和管理数据任务,提高数据的处理效率和准确性。同时,它的可视化界面和丰富的功能也使得用户操作起来更加简单和便捷。

“相关推荐”对你有帮助么?

  • 非常没帮助
  • 没帮助
  • 一般
  • 有帮助
  • 非常有帮助
提交
评论 39
添加红包

请填写红包祝福语或标题

红包个数最小为10个

红包金额最低5元

当前余额3.43前往充值 >
需支付:10.00
成就一亿技术人!
领取后你会自动成为博主和红包主的粉丝 规则
hope_wisdom
发出的红包
实付
使用余额支付
点击重新获取
扫码支付
钱包余额 0

抵扣说明:

1.余额是钱包充值的虚拟货币,按照1:1的比例进行支付金额的抵扣。
2.余额无法直接购买下载,可以购买VIP、付费专栏及课程。

余额充值