1.(转)canal背景与工作原理

Posted PacosonSWJTU

tags:

篇首语:本文由小常识网(cha138.com)小编为大家整理,主要介绍了1.(转)canal背景与工作原理相关的知识,希望对你有一定的参考价值。

【README】

1.canal是一个工具,由阿里开源,用于解析mysql的binlog增量日志,重放日志还原出业务数据,下游可以送入 es,mysql,hbase等;

2.本文以下内容转自:GitHub - alibaba/canal: 阿里巴巴 MySQL binlog 增量订阅&消费组件


【1】 canal背景

【图解】 补充:

  • canal的下游还可以是 java客户端

1)canal [kə'næl],译意为水道/管道/沟渠

  • 主要用途是基于 MySQL 数据库增量日志解析,提供增量数据订阅和消费

2)业务背景:

  • 早期阿里巴巴因为杭州和美国双机房部署,存在跨机房同步的业务需求,实现方式主要是基于业务 trigger 获取增量变更。从 2010 年开始,业务逐步尝试数据库日志解析获取增量变更进行同步,由此衍生出了大量的数据库增量订阅和消费业务。

3)基于日志增量订阅和消费的业务包括

  • 数据库镜像
  • 数据库实时备份
  • 索引构建和实时维护(拆分异构索引、倒排索引等)
  • 业务 cache 刷新
  • 带业务逻辑的增量数据处理
  • 当前的 canal 支持源端 MySQL 版本包括 5.1.x , 5.5.x , 5.6.x , 5.7.x , 8.0.x

 【1】canal工作原理

转自: GitHub - alibaba/canal: 阿里巴巴 MySQL binlog 增量订阅&消费组件

1)mysql主从复制原理

  • MySQL master 将数据变更写入二进制日志( binary log, 其中记录叫做二进制日志事件binary log events,可以通过 show binlog events 进行查看)
  • MySQL slave 将 master 的 binary log events 拷贝到它的中继日志(relay log)
  • MySQL slave 重放 relay log 中事件,将数据变更反映它自己的数据

2)canal 工作原理

  • canal 模拟 MySQL slave 的交互协议,伪装自己为 MySQL slave ,向 MySQL master 发送dump 协议;(canal把自己伪装成一个 mysql slave节点,向master发送 dump协议获取binlog日志)
  • MySQL master 收到 dump 请求,开始推送 binary log 给 slave (即 canal );
  • canal 解析 binary log 对象(原始为 byte 流);

以上是关于1.(转)canal背景与工作原理的主要内容,如果未能解决你的问题,请参考以下文章

大数据Canal:Canal介绍

canal搭建实例

canal 使用详解

canal+mysql+kafka安装配置

Canal:部署CanalCanal Admin & 使用ZooKeeper进行集群管理

Canal增量数据同步利器介绍与安装