TiDB数据库使用syncer工具同步实时数据

mysql> select campaign_id ,count(id) from creative_output group by campaign_id;

 rows in set ( min 44.23 sec)

mysql> select is_cr_own ,count(id) from creative_output group by is_cr_own;

 rows in set (44.55 sec)

首先是查看tidb数据库的syncer工具的介绍

使用syncer工具的场景一般是：

　　全量导入历史数据后，通过增量的方式同步新的数据（需要 checker + mydumper + loader + syncer）。该场景需要提前开启 binlog 且格式必须为 ROW。

主要的步骤我们可以看官网链接：

https://pingcap.com/docs-cn/op-guide/migration-overview/

注意：mysql必须开启几项服务才行，主要是bin-log功能，Binlog格式等等，详细请查看：https://pingcap.com/docs-cn/tools/syncer/ 的后半部分内容。

有一个文件syncer.mata需要注意：

我创建并编辑好这个文件后放在了/usr/local/tidb-tools目录下面，这个文件的目录需要在config.toml的内容中指定一下。但是我的重点是要说上面这个图片中的“binlog-gtid”这一行的内容。因为我本次实验没有用到主从环境，所以暂时不考虑binlog-gtid的问题，下面列一下我的文件内容

我只写了这两行数据，不过虽然没有用到binlog-gtid的功能，也应该指定出来，把binlog-pos设置为空就可以了，例如：binlog-pos=""

然后我们最好使用配置文件config.toml来启动syncer。config.toml文件可以放在任一位置，在启动syncer时提供文件即可：例如

其实位置是小问题，只是我在看文章的时候纠结z这个位置是在哪里呢，后来才知道是小问题。

还有几个报错的，我们需要注意一下：

1、报错：就是启动syncer的时候直接报错

居然不能连接mysql这肯定是配置文件的原因，查看一下来：

log-level = "info"

server-id = 

## meta 文件地址

meta = "/usr/local/tidb-tools/syncer.meta"

worker-count =

batch = 

## pprof 调试地址, Prometheus 也可以通过该地址拉取 syncer metrics

## 将 127.0.0.1 修改为相应主机 IP 地址

status-addr = "172.31.30.62:10086"

## 跳过 DDL 或者其他语句，格式为 **前缀完全匹配**，如: `DROP TABLE ABC`,则至少需要填入`DROP TABLE`.

# skip-sqls = ["ALTER USER", "CREATE USER"]

## 在使用 route-rules 功能后，

## replicate-do-db & replicate-ignore-db 匹配合表之后(target-schema & target-table )数值

## 优先级关系: replicate-do-db --> replicate-do-table --> replicate-ignore-db --> replicate-ignore-table

## 指定要同步数据库名；支持正则匹配，表达式语句必须以 `~` 开始

#replicate-do-db = ["~^b.*","s1"]

## 指定要同步的 db.table 表

## db-name 与 tbl-name 不支持 `db-name ="dbname，dbname2"` 格式

#[[replicate-do-table]]

#db-name ="dbname"

#tbl-name = "table-name"

#[[replicate-do-table]]

#db-name ="dbname1"

#tbl-name = "table-name1"

## 指定要同步的 db.table 表；支持正则匹配，表达式语句必须以 `~` 开始

#[[replicate-do-table]]

#db-name ="test"

#tbl-name = "~^a.*"

## 指定**忽略**同步数据库；支持正则匹配，表达式语句必须以 `~` 开始

#replicate-ignore-db = ["~^b.*","s1"]

## 指定**忽略**同步数据库

## db-name & tbl-name 不支持 `db-name ="dbname，dbname2"` 语句格式

#[[replicate-ignore-table]]

#db-name = "your_db"

#tbl-name = "your_table"

## 指定要**忽略**同步数据库名；支持正则匹配，表达式语句必须以 `~` 开始

#[[replicate-ignore-table]]

#db-name ="test"

#tbl-name = "~^a.*"

# sharding 同步规则，采用 wildcharacter

# . 星号字符 (*) 可以匹配零个或者多个字符,

#    例子, doc* 匹配 doc 和 document, 但是和 dodo 不匹配;

#    星号只能放在 pattern 结尾，并且一个 pattern 中只能有一个

# . 问号字符 (?) 匹配任一一个字符

#[[route-rules]]

#pattern-schema = "route_*"

#pattern-table = "abc_*"

#target-schema = "route"

#target-table = "abc"

#[[route-rules]]

#pattern-schema = "route_*"

#pattern-table = "xyz_*"

#target-schema = "route"

#target-table = "xyz"

[from]

host = "172.31.30.62"                                #是这一步出错了

user = "root"

password = ""

port = 

[to]

host = "172.31.30.62"

user = "root"

password = ""

port =

不知道大概什么问题，虽然我的mysql和tidb主节点在一个机器上面，但是连接的时候指定不同的端口就可以了，可是在这里就是行不通，我猜应该是hosts文件映射的问题吧，但是我没有修改hosts文件，只是把上面的黄色区域的内容修改了为：“127.0.0.1”就成功了，我们看一下成功的例子：

然后你在mysql中插入数据，syncer会实时写入tidb数据库中。

即便把syncer关掉之后，这个时候虽然不会同步，但是一启动进程就会立即同步mysql中之前未同步到tidb中的数据。

下面这是syncer的同步进程，在config.toml指定的

TiDB数据库使用syncer工具同步实时数据的更多相关文章

C#同步SQL Server数据库中的数据--数据库同步工具[同步新数据]
C#同步SQL Server数据库中的数据 1. 先写个sql处理类: using System; using System.Collections.Generic; using System.Dat ...
TiDB 作为 MySQL Slave 实现实时数据同步
由于 TiDB 本身兼容绝大多数的 MySQL 语法,所以对于绝大多数业务来说,最安全的切换数据库方式就是将 TiDB 作为现有数据库的从库接在主 MySQL 库的后方,这样对业务方实现完全没有侵入性 ...
Sqlserver2000联系Oracle11G数据库进行实时数据的同步
Sqlserver2000联系Oracle11G数据库进行实时数据的同步 1,前提条件我有sqlserver2000环境,已经存在oracle11g环境,准备这两个数据库,建立各自的訪问账号,两者之 ...
使用sqlyog工具同步两个相同结构的数据库之间的数据
compare two database data 因为工作上遇到同一个项目被部署到不同服务器上,原项目(后统称"源")在运行中,后部署的项目(后统称"目标" ...
基于 WebSocket 实现 WebGL 3D 拓扑图实时数据通讯同步（二）
我们上一篇<基于 WebSocket 实现 WebGL 3D 拓扑图实时数据通讯同步(一)>主要讲解了如何搭建一个实时数据通讯服务器,客户端与服务端是如何通讯的,相信通过上一篇的讲解,再配 ...
通过 WebSocket 实现 WebGL 3D 拓扑图实时数据通讯同步（二）
我们上一篇<基于 WebSocket 实现 WebGL 3D 拓扑图实时数据通讯同步(一)>主要讲解了如何搭建一个实时数据通讯服务器,客户端与服务端是如何通讯的,相信通过上一篇的讲解,再配 ...
推荐一个同步Mysql数据到Elasticsearch的工具
把Mysql的数据同步到Elasticsearch是个很常见的需求,但在Github里找到的同步工具用起来或多或少都有些别扭. 例如:某记录内容为"aaa|bbb|ccc",将其按 ...
Tapdata Real Time DaaS 技术详解 PART I ：实时数据同步
摘要:企业信息化过程形成了大量的数据孤岛,这些并不连通的数据孤岛是企业数字化转型的巨大挑战.Tapdata Real Time DaaS 采用的CDC模式,具有巨大的优势,同时是一个有技术壁垒的活 ...
TiDB数据库 mydumper与loader导入数据
从mysql导出数据最好的方法是使用tidb官方的工具mydumper. 导入tidb最好的方法是使用loader工具,大概19.4G每小时的速度. 详细的步骤可以参考官网:https://pingc ...

随机推荐

第一次项目上Linux服务器（二:——安装jdk）
本人采用的是rpm安装jdk1.8 1.下载jdk 去jdk下载页面找到要下载的jdk 本人下载的是jdk-8u161-linux-x64.rpm,百度云资源链接:链接:https://pan.bai ...
ruby中字符串转换为类
最近有个需求,需要根据一个字符串当作一个类来使用,例如: 有一个字符串 “ChinaMag”,根据这个字符串调用类 ChinaMag下的方法. 解决办法: 1. rails可以使用 constant ...
Mybatis 的配置xml和properties放在jar包以外的一种方法
1.问题开发时候,将xml和properties放resources,直接可以访问到,然而打包后这两个文件也一同被打包到jar包里面,如果发布后想修改就会比较麻烦,所以希望将xml配置文件和prop ...
node.js遇到的问题
1.cann't find module 'request' 不能找到’request' 模块解决方法:找到项目的根路径,cd到该路径,运行命令 npm install request 2.no ...
ABB机器人---PCSDK简介
BB机器人为用户提供了大量便捷的二次开发及应用工具,PCSDK就是其中一项. 1) 首先,机器人使用PCSDK,必须要有pc interface选项. 2)此处举例使用C#编写简单界面,实现与机器人数 ...
第15课-数据库开发及ado.net-数据库介绍,主键,外键,启动数据库,数据库身份验证方式,建表,分离数据库
第15课-数据库开发及ado.net 数据库介绍,主键,外键,启动数据库,数据库身份验证方式,建表,分离数据库 1. 学习方法 2. 多涨见识 3. 比自己强的人一起,学习更强:比自己更聪明的人 ...
MYSQL查询优化：Limit
Limit语法: SELECT * FROM table LIMIT [offset,] rows | rows OFFSET offset LIMIT子句可以被用于强制 SELECT 语句返回指定的 ...
彻底理解voliate
1.voliate简介在上一篇文章中我们深入理解了java关键字synchronized,我们知道在java中还有一大神器就是关键volatile,可以说是和synchronized各领风骚,其中奥 ...
撩课-Web架构师养成系列第一篇
前言 Web架构师养成系列共15篇,每周更新一篇,主要分享.探讨目前大前端领域(前端.后端.移动端)企业中正在用的各种成熟的.新的技术.部分文章也会分析一些框架的底层实现,让我们做到知其然知其所以然. ...
JSP学习笔记（7）-JSP的文件操作
1.File类 File对象用来获取文件本身的一些信息,例如文件所在目录,文件的长度,文件读写权限等,不涉及文件的读写操作. 创建一个File对象的构造方法有3个: File(String filen ...

TiDB数据库 使用syncer工具同步实时数据

TiDB数据库 使用syncer工具同步实时数据的更多相关文章

随机推荐

热门专题

TiDB数据库使用syncer工具同步实时数据

TiDB数据库使用syncer工具同步实时数据的更多相关文章