datax处理mysql关键字_离线数据同步工具-datax使用简介

DataX是阿里开源的异构数据源同步工具,支持MySQL到Oracle等数据源的数据迁移。本文介绍了DataX的基本概念、优点,以及在处理MySQL关键字时的注意事项,包括使用`符号标注、驱动替换和多表增量同步。此外,还提供了性能测试示例。
摘要由CSDN通过智能技术生成

DataX

概述

DataX 是一个异构数据源离线同步工具,致力于实现包括关系型数据库(MySQL、Oracle等)、HDFS、Hive、ODPS、HBase、FTP等各种异构数据源之间稳定高效的数据同步功能。

DataX本身作为数据同步框架,将不同数据源的同步抽象为从源头数据源读取数据的Reader插件,以及向目标端写入数据的Writer插件,理论上DataX框架可以支持任意数据源类型的数据同步工作。同时DataX插件体系作为一套生态系统, 每接入一套新数据源该新加入的数据源即可实现和现有的数据源互通。有如下优点:

可靠的数据质量监控

丰富的数据转换功能

精准的速度控制

强劲的同步性能

健壮的容错机制

极简的使用体验

安装部署

环境准备

jdk1.8+

Python(推荐Python2.7.X)一定要为python2,因为后面执行datax.py的时候,里面的python的print会执行不了,导致运行不成功,会提示你print语法要加括号,python2中加不加都行 python3中必须要加,否则报语法错

Apache Maven 3.x (Compile DataX)

注意配置系统环境变量。

自检测试

进入data目录,执行自检脚本:python D:\datax\bin\datax.py D:\datax\job\job.json,查看日志输出。

如果日志中出现中文乱码,在cmd中输入:CHCP 65001

job脚本

在cmd窗口,执行命令:python {DATAX_HOME}

评论
添加红包

请填写红包祝福语或标题

红包个数最小为10个

红包金额最低5元

当前余额3.43前往充值 >
需支付:10.00
成就一亿技术人!
领取后你会自动成为博主和红包主的粉丝 规则
hope_wisdom
发出的红包
实付
使用余额支付
点击重新获取
扫码支付
钱包余额 0

抵扣说明:

1.余额是钱包充值的虚拟货币,按照1:1的比例进行支付金额的抵扣。
2.余额无法直接购买下载,可以购买VIP、付费专栏及课程。

余额充值