ElasticSearch实战(四十七)-Canal 实现 MySQL 数据实时同步方案

Posted 张志翔ۤ

tags:

篇首语:本文由小常识网(cha138.com)小编为大家整理,主要介绍了ElasticSearch实战(四十七)-Canal 实现 MySQL 数据实时同步方案相关的知识,希望对你有一定的参考价值。

        Canal 主要用途是基于 mysql 数据库增量日志解析,提供增量数据订阅和消费

        早期阿里巴巴因为杭州和美国双机房部署,存在跨机房同步的业务需求,实现方式主要是基于业务 trigger 获取增量变更。从 2010 年开始,业务逐步尝试数据库日志解析获取增量变更进行同步,由此衍生出了大量的数据库增量订阅和消费业务。

        基于日志增量订阅和消费的业务包括

  • 数据库镜像
  • 数据库实时备份
  • 索引构建和实时维护(拆分异构索引、倒排索引等)
  • 业务 cache 刷新
  • 带业务逻辑的增量数据处理

        当前的 Canal 支持源端 MySQL 版本包括 5.1.x , 5.5.x , 5.6.x , 5.7.x , 8.0.x

一、Canal 工作原理

        1、工作原理

        MySQL主备复制原理:

  • MySQL master 将数据变更写入二进制日志( binary log, 其中记录叫做二进制日志事件binary log events,可以通过 show binlog events 进行查看)
  • MySQL slave 将 master 的 binary log events 拷贝到它的中继日志(relay log

以上是关于ElasticSearch实战(四十七)-Canal 实现 MySQL 数据实时同步方案的主要内容,如果未能解决你的问题,请参考以下文章

四十七 Python分布式爬虫打造搜索引擎Scrapy精讲—elasticsearch(搜索引擎)用Django实现搜索的自动补全功能

tableau实战系列(四十七)-Tableau快速生成可视化视图

tableau实战系列(四十七)-Tableau快速生成可视化视图

ElasticSearch实战(四十一)-存储桶聚合

ElasticSearch实战(四十一)-存储桶聚合

ElasticSearch实战(十七)-个性化设置数据字段属性