《数据清洗》:用Kettle工具实现转换和作业

本文详细介绍了如何使用Kettle工具进行数据清洗,包括创建转换和作业。转换部分讲述了如何通过步骤将数据表字段拼接并插入新表;作业部分则展示了如何设置作业发送邮件。通过实例操作,读者可以掌握Kettle在数据处理中的应用。
摘要由CSDN通过智能技术生成

一个数据抽取过程主要包括创建一个作业,并且每个作业可以包括多个转换操作。此数据抽取过程可通过Kettle工具完成,也可以通过编写程序调用的方式实现。   

Kettle工具的执行分为两个层次,即转换和作业,这两个层次最主要的区别在于数据传递和执行方式。

一、转换

转换是ETL解决方案中重要的组成部分之一,主要用于数据的抽取、转换以及加载等操作,其本质是一组图形化的数据转换配置的逻辑结构

一个转换包括一个或多个步骤,转换中的步骤是通过跳连接的。在Kettle中,数据的单位是行,数据流就是数据行从一个步骤到另一个步骤的移动。

1、实现转换的步骤

双击Kettle目录下的Spoon.bat脚本启动Kettle工具,在工具栏处选择“文件”→“新建”→“转换”命令,点击保存就可以给这个转换命名

创建好以后单击Kettle树形列表的核心对象,然后单击“输入”,将“表输入”拖曳到Kettle主界面的工作区,而后单击“输出”,将“文本文件输出”也拖曳到Kettle的工作区,按住Ctrl键的同时选中“表输入”和“文本文件输出”并右击,从弹出的快捷菜单中选择“新建节点连接”命令,在弹出的窗口中选择“起始步骤”和“目标步骤”,单击“确认”按钮,建立“表输入”向“文本文件输出” 的链接

在Kettle主界面的工作区右击空白处,选择“新建注释”命令可以添加注释

评论
添加红包

请填写红包祝福语或标题

红包个数最小为10个

红包金额最低5元

当前余额3.43前往充值 >
需支付:10.00
成就一亿技术人!
领取后你会自动成为博主和红包主的粉丝 规则
hope_wisdom
发出的红包
实付
使用余额支付
点击重新获取
扫码支付
钱包余额 0

抵扣说明:

1.余额是钱包充值的虚拟货币,按照1:1的比例进行支付金额的抵扣。
2.余额无法直接购买下载,可以购买VIP、付费专栏及课程。

余额充值