1.转换
转换是ETL解决方案中重要的组成部分之一,主要用于数据的抽取、转换以及加载等操作,其本质是一组图形化的数据转换配置的逻辑结构。一个转换包括一个或多个步骤,如读取文件、过滤数据行、数据清洗或将数据加载到数据库等步骤。转换的步骤是通过跳连接的。跳定义了一个单向通道,允许数据从一个步骤向另一个步骤流动。在kettle中,数据的单位是行,数据流动是数据行从一个步骤到另一个步骤的移动。
一个转换的例子:
2.作业
一个作业包含一个或者多个作业项,并且这些作业项都是以某种顺序执行的。作业的执行顺序由作业项之间的跳(Job Hop)和每个作业项的执行结果决定。
一个简单的作业例子: