关系型数据库到MongoDB实时数据同步解决方案

2020-03-10 10:00

关系型数据库 – MongoDB 异构同步


场景:主机下行

新型应用往往具有大量读操作和高并发的特征, 传统主机架构性能扩展不易,成本太高且开发困难。

直接更换核心系统更加困难。

采用CQRS 模式,数据同步到分布式数据库,并在上面开发新型应用。


场景:数据库现代化

关系型数据库基于单机架构,不容易横向扩展,难以支撑现代应用所需要的海量数据。

物联网,新一代CRM等系统需要灵活的数据模型来支撑非结构化和半结构化。


Tapdata 解决方案

  • 使用MongoDB作为主机下行或新一代数据库的选择,将业务数据从已有主机或Oracle等关系型数据库复制到MongoDB;

  • 使用Tapdata Replicator的CDC技术,实时监听现有业务库的数据变动并同步至MongoDB;

  • 使用Tapdata 的RDM技术将关系型表合并转型到MongoDB JSON数据结构,并保持和源库的高度数据一致;

  • 在MongoDB上进行新业务的开发。


技术挑战


异构数据库模型匹配

关系模型基于范式,文档模型基于对象,很多ETL工具不能很好支持MongoDB。


实时同步能力

批量迁移数据较为简单,但是实时同步涉及到数据库底层逻辑,一般开发者处理较为困难


关键应用需要企业级可靠性

- 如何提供迁移的高可用?

- 如何保证数据的一致性?

- 如何处理宕机后的场景?


Tapdata 提供的价值


实时异构数据库同步

低延迟从Sybase复制数据到MongoDB

复制延迟 < 500ms


自动模型转换

自动实现关系型结构到JSON文档结构的转换

支持1-1, N-1,1-N,N-N等数据关系


企业级功能与支持

GUI驱动,无须代码

支持高可用部署,无须担心同步中断

数据校验,故障告警等机制保障线上可靠运行


客户案例:某政府医疗机构数据库现代化


现状

  • 该机构管理数十家公立医院及数百个诊所并统一负责这些医院和诊所的数十套IT系统的开发及运营维护;

  • CMS, EPR等系统由于病人数据的持续增长,已经有明显的性能问题影响体验;

  • 目前的高可用及Dr架构不能满足业务需求,无法做到跨中心高可用;

  • 已有架构管理复杂,创新困难,无法支撑面向市民的移动APP等新型场景。


新模式

  1. 构建私有云体系,并提供基于PaaS的开发测试发布平台;

  2. 使用Docker, Spring, Microservice等技术满足新型开发,快速上线的需求;

  3. 使用新一代数据库解决数据跨中心自动容灾,海量非结构化文件(如Xray,PDF等),及高并发读写的需求场景;

  4. 在逐渐向新 IT 模式过渡的过程中,保证已有系统的平稳运行。


双模式并行架构


hospital-arch.png


推荐阅读

Tapdata 推出“钛计划”公益项目,着力打通数据孤岛助推社会数字化升级

为响应数据要素市场化配置改革政策方向的指引,Tapdata 推出“钛计划”打通数据孤岛公益行动,面向非盈利机构(如各城市政务服务数据管理局、社会公益组织/项目等)以及为社会培养数据技术人才的相关培训机构,提供 Tapdata 实时数据服务平台的特殊免费授权,助推公共领域数据互通、共享与实时应用......

Tapdata 钛铂数据的产品理念

Tapdata 是全球首个基于数据即服务架构理念、面向 TP 场景的企业实时主数据服务平台,可以帮助企业快速实现主数据的统一管理和发布,并为所有数据库、数仓、大数据平台提供最实时的源数据,让数据随时可用。

Tapdata Cloud 是什么?

Tapdata Cloud 是钛铂数据自研的异构数据库实时同步工具 Tapdata Replicator 的云服务版本,现在免费提供所有开发者和企业使用Tapdata Cloud 目前支持 Oracle、MySQL、PostgreSQL、SQL Server、MongoDB、Elasticsearch 之间的数据迁移和同步,未来将陆续上线 DB2、Sybase ASE、Redis、Kafka 等。

什么是数据即服务(Data as a Service)?

数据即服务(DaaS)是一种数据管理策略,旨在利用数据作为业务资产来提高业务创新的敏捷性。它是自 1990 年代互联网高速发展以来越来越受欢迎的“一切皆服务”(XaaS)趋势下关于数据服务化的那一部分,介于 PaaS 和 SaaS 之间。与 SaaS 类似,DaaS 提供了一种方式来管理企业每天生成的大量数据,并在整个业务范围内提供这些有价值的信息,以便于进行数据驱动的商业决策。同时,我们也...

什么是数据虚拟化(Data Virtualization)?

本文将简单易懂地介绍数据虚拟化技术及数据虚拟化软件架构的实现方法,尽量避免教条主义。如需要了解虚拟化定义,可通过wiki 百科了解。先引用一段百度百科的文字来说明数据虚拟化的定义:数据虚拟化(data virtualization)是用来描述所有数据管理方法的涵盖性术语,这些方法允许应用程序检索并管理数据,且不需要数据相关的技术细节,例如它格式化的方式或物理位置所在。正如百科的定义,采用数据...

Tapdata 数据库实时同步的技术要点

Tapdata 专注于实时数据的处理技术,在数据库迁移和同步方面,Tapdata 的表现非常优秀,实时、多元、异构,尤其在关系数据库到非关系数据库之间的双向同步方面,无论是从操作上,还是效率上,都体现了业界领先的水平。本文重点阐述 Tapdata 在数据库实时同步方面的技术要点。

教育中台与第三方系统对接整合数据案例

最近, 南京秦淮区教育中台系统,成功地和市系统进行了一次圆满对接。通过教育中台提供的统一数据能力和低代码API对接能力,实现了对市系统数据的实时推送和拉取,以及各类业务逻辑上的处理。这次对接为南京市中小学生创客大赛的成功举办提供了及时可靠的数据支撑, 体现了中台系统在快速响应业务方面的优越性。

周生生 | 全渠道商品中心建设

通过Tapdata 构建全渠道商品中心,实现: - 支持中国大陆港澳台的上千家门店的生产环境; - 使用JS脚本来进行流处理计算,业务需求从开发到上线过程快至 1 天以内; - 任务配置与执行监测全程可视化操作,不懂技术也能完成操作,极大降低维护成本; - 一套产品可满足不同需求,根据业务需求产出不同类型的业务模型节省大量人力物力。

关系型数据库到MongoDB实时数据同步解决方案

使用MongoDB作为主机下行或新一代数据库的选择,将业务数据从已有主机或Oracle等关系型数据库复制到MongoDB; 使用Tapdata Replicator的CDC技术,实时监听现有业务库的数据变动并同步至MongoDB; 使用Tapdata 的RDM技术将关系型表合并转型到MongoDB JSON数据结构,并保持和源库的高度数据一致; 在MongoDB上进行新业务的开发。

Tapdata肖贝贝:实时数据引擎系列(一)-新鲜的数据流

前言2006 年诞生的 hadoop 和 她周边的生态, 在过去的这些年里为大数据的火热提供了足够的能量, 十几年过去了, 场景在变化, 技术在演变, 大家对数据的认知已经不再局限于 T+1 与 高吞吐高延迟 为主要特征的上一代框架理念, 在真实的场景里, 实时, 准确, 多变 的数据也发挥着越来越重要的作用为满足这些新的需求, 各种框架和中间件如雨后春笋般不断涌出hive 的出现让这头大象...
联络我们:
Email:team@tapdata.io    电话:0755-26656080
深圳市南山区临海大道香江金融中心 2410-13
官方服务号
Tapdata 微信公众号
扫码关注