一、Sqoop 概述
1、Sqoop 简介
Sqoop是一款开源的数据迁移工具,主要用于在 Hadoop(Hive)与传统数据库(Mysql、Oracle...)间进行数据的相互传递,可以将一个关系型数据库(MySQL、Oracle、Postgres 等)中的数据导入到 Hadoop 的 HDFS 中,也可以将 HDFS 的数据导出到关系型数据库中。
Sqoop项目开始于2009年,最早是作为Hadoop的一个第三方模块存在,后来为了让使用者能够快速部署,也为了让开发人员能够更快速的迭代开发,Sqoop独立成为一个Apache项目。
Sqoop2的最新版本是1.99.7。
请注意,2与1不兼容,且特征不完整,它并不打算用于生产部署。
2、Sqoop原理