DataX是阿里云DataWorks数据集成的开源版本。
Go to file
2020-08-13 16:15:49 +08:00
adbpgwriter Bump jdk to 1.8 2019-11-08 15:08:16 +08:00
adswriter Bump jdk to 1.8 2019-11-08 15:08:16 +08:00
cassandrareader Bump jdk to 1.8 2019-11-08 15:08:16 +08:00
cassandrawriter Bump jdk to 1.8 2019-11-08 15:08:16 +08:00
clickhousewriter Fix missing simulator package #661 #676 2020-05-25 16:10:38 +08:00
common Bump jdk to 1.8 2019-11-08 15:08:16 +08:00
core Merge pull request #447 from lzrlizhirong/master 2020-08-05 17:01:45 +08:00
drdsreader Bump jdk to 1.8 2019-11-08 15:08:16 +08:00
drdswriter Bump jdk to 1.8 2019-11-08 15:08:16 +08:00
elasticsearchwriter Bump jdk to 1.8 2019-11-08 15:08:16 +08:00
ftpreader Bump jdk to 1.8 2019-11-08 15:08:16 +08:00
ftpwriter Update ftpwriter.md 2020-05-13 17:55:16 +08:00
gdbreader gdbreader: reader for Aliyun GDB 2020-04-13 10:29:33 +08:00
gdbwriter gdbwriter: update column index prefix 2020-08-12 15:18:33 +08:00
hbase11xreader Bump jdk to 1.8 2019-11-08 15:08:16 +08:00
hbase11xsqlreader Bump jdk to 1.8 2019-11-08 15:08:16 +08:00
hbase11xsqlwriter Bump jdk to 1.8 2019-11-08 15:08:16 +08:00
hbase11xwriter Bump jdk to 1.8 2019-11-08 15:08:16 +08:00
hbase20xsqlreader Bump jdk to 1.8 2019-11-08 15:08:16 +08:00
hbase20xsqlwriter Bump jdk to 1.8 2019-11-08 15:08:16 +08:00
hbase094xreader Bump jdk to 1.8 2019-11-08 15:08:16 +08:00
hbase094xwriter Bump jdk to 1.8 2019-11-08 15:08:16 +08:00
hdfsreader Bump jdk to 1.8 2019-11-08 15:08:16 +08:00
hdfswriter Bump jdk to 1.8 2019-11-08 15:08:16 +08:00
images Add files via upload 2020-08-12 12:27:20 +08:00
mongodbreader 补充mongodbreader文档,修正部分文档错误。 2020-07-03 14:47:28 +08:00
mongodbwriter Bump jdk to 1.8 2019-11-08 15:08:16 +08:00
mysqlreader Bump jdk to 1.8 2019-11-08 15:08:16 +08:00
mysqlwriter Update mysqlwriter.md 2020-05-25 13:43:47 +08:00
ocswriter Bump jdk to 1.8 2019-11-08 15:08:16 +08:00
odpsreader Merge pull request #229 from csurong/csurong_dev 2020-08-05 17:02:38 +08:00
odpswriter Update odpswriter.md 2020-05-26 01:51:08 +08:00
opentsdbreader Bump jdk to 1.8 2019-11-08 15:08:16 +08:00
oraclereader Update oraclereader.md 2020-07-08 15:01:14 +08:00
oraclewriter Bump jdk to 1.8 2019-11-08 15:08:16 +08:00
ossreader Bump jdk to 1.8 2019-11-08 15:08:16 +08:00
osswriter Merge pull request #486 from c-agam/patch-1 2020-08-05 17:04:19 +08:00
otsreader Bump jdk to 1.8 2019-11-08 15:08:16 +08:00
otsstreamreader Merge pull request #428 from zhouzf05/master 2020-08-05 17:12:57 +08:00
otswriter Bump jdk to 1.8 2019-11-08 15:08:16 +08:00
plugin-rdbms-util replace @table in querySql 2020-08-13 16:15:49 +08:00
plugin-unstructured-storage-util v0.0 2018-01-31 16:24:49 +08:00
postgresqlreader Bump jdk to 1.8 2019-11-08 15:08:16 +08:00
postgresqlwriter 更新postgresqlwriter.md文件中关于*未展示的问题 2020-06-02 15:10:59 +08:00
rdbmsreader 修复rdbmsreader插件,无法plugin.json下驱动,导致数据库连接报错问题 2020-07-21 15:03:26 +08:00
rdbmswriter 修复rdbmswriter插件,无法plugin.json下驱动,导致数据库连接报错问题 2020-07-21 15:03:40 +08:00
rpm v0.0 2018-01-31 16:24:49 +08:00
sqlserverreader Bump jdk to 1.8 2019-11-08 15:08:16 +08:00
sqlserverwriter Bump jdk to 1.8 2019-11-08 15:08:16 +08:00
streamreader Bump jdk to 1.8 2019-11-08 15:08:16 +08:00
streamwriter Bump jdk to 1.8 2019-11-08 15:08:16 +08:00
transformer 补充mongodbreader文档,修正部分文档错误。 2020-07-03 14:47:28 +08:00
tsdbreader Add TSDB Reader 2019-11-08 16:52:39 +08:00
tsdbwriter Bump jdk to 1.8 2019-11-08 15:08:16 +08:00
txtfilereader Bump jdk to 1.8 2019-11-08 15:08:16 +08:00
txtfilewriter Update txtfilewriter.md 2020-06-19 15:24:24 +08:00
.gitignore Add OpenTSDB reader and TSDB writer 2019-04-26 14:53:55 +08:00
datax-opensource-dingding.png v0.0 2018-01-31 16:24:49 +08:00
dataxPluginDev.md Merge pull request #626 from sqdf1990/modify_dataxPluginDev_md 2020-08-05 16:59:35 +08:00
introduction.md Update README.md 2018-02-04 11:33:54 +08:00
license.txt v0.0 2018-01-31 16:24:49 +08:00
package.xml Add Clickhouse Writer 2020-04-14 21:22:23 +08:00
pom.xml Merge pull request #639 from heljoyLiu/new-plugin-gdbreader 2020-04-23 11:36:47 +08:00
README.md Update README.md 2020-08-12 12:41:59 +08:00
userGuid.md Update userGuid.md 2019-11-14 10:30:24 +08:00

Datax-logo

DataX

DataX 是阿里巴巴集团内被广泛使用的离线数据同步工具/平台,实现包括 MySQL、Oracle、SqlServer、Postgre、HDFS、Hive、ADS、HBase、TableStore(OTS)、MaxCompute(ODPS)、DRDS 等各种异构数据源之间高效的数据同步功能。

Features

DataX本身作为数据同步框架将不同数据源的同步抽象为从源头数据源读取数据的Reader插件以及向目标端写入数据的Writer插件理论上DataX框架可以支持任意数据源类型的数据同步工作。同时DataX插件体系作为一套生态系统, 每接入一套新数据源该新加入的数据源即可实现和现有的数据源互通。

DataX详细介绍

请参考:DataX-Introduction

Quick Start

Download DataX下载地址
请点击:Quick Start

Support Data Channels

DataX目前已经有了比较全面的插件体系主流的RDBMS数据库、NOSQL、大数据计算系统都已经接入目前支持数据如下图详情请点击DataX数据源参考指南

类型 数据源 Reader(读) Writer(写) 文档
RDBMS 关系型数据库 MySQL
            Oracle         √         √    
SQLServer
PostgreSQL
DRDS
通用RDBMS(支持所有关系型数据库)
阿里云数仓数据存储 ODPS
ADS
OSS
OCS
NoSQL数据存储 OTS
Hbase0.94
Hbase1.1
Phoenix4.x
Phoenix5.x
MongoDB
Hive
Cassandra
无结构化数据存储 TxtFile
FTP
HDFS
Elasticsearch
时间序列数据库 OpenTSDB
TSDB

我要开发新的插件

请点击:DataX插件开发宝典

项目成员

核心Contributions: 言柏 、枕水、秋奇、青砾、一斅、云时

感谢天烬、光戈、祁然、巴真、静行对DataX做出的贡献。

License

This software is free to use under the Apache License Apache license.

请及时提出issue给我们。请前往DataxIssue

开源版DataX企业用户

Datax-logo

长期招聘 联系邮箱datax@alibabacloud.com
【JAVA开发职位】
职位名称JAVA资深开发工程师/专家/高级专家
工作年限 : 2年以上
学历要求 : 本科(如果能力靠谱,这些都不是条件)
期望层级 : P6/P7/P8

岗位描述:
    1. 负责阿里云大数据平台(数加)的开发设计。 
    2. 负责面向政企客户的大数据相关产品开发;
    3. 利用大规模机器学习算法挖掘数据之间的联系,探索数据挖掘技术在实际场景中的产品应用 
    4. 一站式大数据开发平台
    5. 大数据任务调度引擎
    6. 任务执行引擎
    7. 任务监控告警
    8. 海量异构数据同步

岗位要求:
    1. 拥有3年以上JAVA Web开发经验
    2. 熟悉Java的基础技术体系。包括JVM、类装载、线程、并发、IO资源管理、网络
    3. 熟练使用常用Java技术框架、对新技术框架有敏锐感知能力深刻理解面向对象、设计原则、封装抽象
    4. 熟悉HTML/HTML5和JavaScript熟悉SQL语言
    5. 执行力强,具有优秀的团队合作精神、敬业精神;
    6. 深刻理解设计模式及应用场景者加分;
    7. 具有较强的问题分析和处理能力、比较强的动手能力,对技术有强烈追求者优先考虑;
    8. 对高并发、高稳定可用性、高性能、大数据处理有过实际项目及产品经验者优先考虑;
    9. 有大数据产品、云产品、中间件技术解决方案者优先考虑。

钉钉用户群:

  • DataX开源用户交流群

  • DataX开源用户交流群2

  • DataX开源用户交流群3

  • DataX开源用户交流群4

  • DataX开源用户交流群5