Kettle转换与作业

目录

1.Kettle相关概念

2.转换实操

3.作业实操 


1.Kettle相关概念

一个数据抽取过程主要包括创建一个作业,并且每个作业可以包括多个转换操作,此数据抽取过程可以通过kettle工具完成。Kettle工具的执行分为两个层次及转换和作业,这两个层次最主要的区别在于数据传递和执行方式。
转换是ETL解决方案中重要的组成部分之一,主要用于数据的抽取、转换以及加载等操作,其本质是一组图形化的数据转换配置的逻辑结构。一个转换包括一个或多个步骤,如读取文件、过滤输出行、数据清洗或将数据加载到数据库中等步骤。转换中的步骤是通过连接的,跳定义了一个单向通道,允许数据从一个步骤向另一个步骤流动,在Kettle中,数据的单位是,数据流就是数据行从一个步骤到另一个步骤地移动;

相对而言,作业更加关心更为宏观的数据处理,比如文件和目录操作等等。一个作业包含一个或者多个作业项,并且这些作业项都是以某种顺序进行执行的。作业执行的顺序由作业项之间的跳和每个作业项的执行结果决定。对于一个作业项来说,只有当该作业项之前的所有作业项执行完毕后,才会执行该作业项。

2.转换实操

打开Kettle(Spoon.bat),依次点击 “文件”-->“新建”-->“转换” 可以得到一个如下界面:

<

  • 1
    点赞
  • 5
    收藏
    觉得还不错? 一键收藏
  • 0
    评论
评论
添加红包

请填写红包祝福语或标题

红包个数最小为10个

红包金额最低5元

当前余额3.43前往充值 >
需支付:10.00
成就一亿技术人!
领取后你会自动成为博主和红包主的粉丝 规则
hope_wisdom
发出的红包
实付
使用余额支付
点击重新获取
扫码支付
钱包余额 0

抵扣说明:

1.余额是钱包充值的虚拟货币,按照1:1的比例进行支付金额的抵扣。
2.余额无法直接购买下载,可以购买VIP、付费专栏及课程。

余额充值