数据迁徙是每个后端都会遇到的工作之一,本文介绍了一些常见的数据迁徙方法与工具

mysqldump:数据结构不变的数据迁徙

  1. 导出数据

    mysqldump -u root -p DATABASE_NAME table_name > dump.sql
  2. 恢复数据

    mysql -u root -p DATABESE_NAME < dump.sql

    或者连接mysql客户端

    mysql> source dump.sql

使用pymysql连接数据库

  1. 可以直接用用户名密码连接的数据库

    class GeneralConnector:
    def __init__(self, config, return_dic=False):
    self.return_dic = return_dic
    self.config = config def __enter__(self):
    self.conn = pymysql.connect(**self.config, port=3306)
    if self.return_dic:
    # 一行数据会变成一个字典
    self.cursor = self.conn.cursor(pymysql.cursors.DictCursor)
    else:
    self.cursor = self.conn.cursor()
    return self.cursor def __exit__(self, *args):
    self.cursor.close()
    self.conn.commit()
    self.conn.close()

    使用:

    # local_db = {
    # 'user': 'root',
    # 'passwd': '',
    # 'host': '127.0.0.1',
    # 'db': 'local_db'
    # }
    with GeneralConnector(const.local_db, return_dic=True) as cursor:
    cursor.execute('SELECT `col1`, `col2` FROM test;')
    return cursor.fetchall()
  2. 连接处于需要SSH连接的服务器的数据库

    class SSHConnector:
    def __init__(self, server, config, return_dic=False):
    self.return_dic=return_dic
    self.server = server
    self.config = config def __enter__(self):
    self.conn = pymysql.connect(**self.config, port=self.server.local_bind_port)
    if self.return_dic:
    # 一行数据会变成一个字典
    self.cursor = self.conn.cursor(pymysql.cursors.DictCursor)
    else:
    self.cursor = self.conn.cursor()
    return self.cursor def __exit__(self, *args):
    self.cursor.close()
    self.conn.commit()
    self.conn.close()

    使用:

    # SERVER = SSHTunnelForwarder(
    # (remote_host, ssh_port),
    # ssh_username=USERNAME,
    # ssh_pkey=SSH_KEY,
    # ssh_private_key_password=SSH_KEY_PASSWD,
    # remote_bind_address=('127.0.0.1', 3306) # mysql服务位置
    # )
    # server_db = {
    # 'user': 'root',
    # 'passwd': '',
    # 'host': '127.0.0.1',
    # 'db': 'server_db'
    # }
    # 创建一个隧道将服务端的mysql绑定到本地3306端口
    with const.SERVER as server:
    with SSHConnector(server, const.server_db) as cursor:
    cursor.execute('show tables;')
    data = cursor.fetchall()
    print(data)

cursor的各种操作

  1. cursor.execute(sql_statement)

    执行一条sql语句

  2. cursor.fetchall()

    获取cursor的所有结果,常跟在select语句后使用

  3. cursor.fetchone()

    获取cursor的第一条结果

  4. cursor.lastrowid

    最后一条数据的id

  5. cursor.executemany(insert_statement, data_list)

    批量插入一批数据,如

    with const.SERVER as server:
    with connector.Connector(server, const.db_1) as cursor:
    cursor.execute('select * from preference')
    preferences = cursor.fetchall() with connector.Connector(server, const.db_2) as cursor:
    cursor.executemany('insert into preference (`id`,`theme`,`user_id`) values (%s,%s,%s)',preferences)

从cursor获取list类型的结果

cursor.execute('SELECT `name` FROM user;')

直接使用fetchall(),只能得到tuple包裹的数据

cursor.fetchall()
# (('Jack',), ('Ben'))

现在希望得到一个list结果集,做到像Django中flat=True那样的效果

有两种方法

  1. 列表解析式(list comprehension)

    name_list = [x[0] for x in cursor.fetchall()]

    这个方法的缺点在于会先使用fetchall()将结果集读到内存,再做列表转换,并不高效。

  2. itertools工具

    name_list = list(itertools.chain.from_iterable(cursor))

    推荐使用这个方式,第一它不会将所有结果fetch到内存中,第二使用itertools生成列表比列表解析式要快

如何在数据迁徙中使用Django的model

  1. 需要拷贝Django的settings文件,删掉不需要的配置,并设置好迁徙目标数据库

  2. 需要拷贝用到此model的文件

  3. 需要在settings.INSTALLED_APPS中引入models.py文件所在的目录

  4. 在迁徙脚本头部启动Django

    import os
    import django
    import sys
    sys.path.append(os.path.dirname(os.path.dirname(os.path.abspath(__file__))))
    os.environ.setdefault("DJANGO_SETTINGS_MODULE", "translate.settings")
    django.setup()

通过SSH隧道的本地转发实现Django连接远程数据库

  1. 创建一个ssh隧道,将远程数据库映射到本地端口

    ssh -L local_port:localhost:<remote mysql port> <username>@<remote host>

    ssh连接进行时,可以通过访问本地端口来访问远程数据库

  2. 在Django的settings中配置数据库

    DATABASES = {
    'default': {
    'ENGINE': 'django.db.backends.mysql',
    'NAME': db_name,
    'USER': remote_mysql_user, # 远程数据库账号密码
    'PASSWORD': remote_mysql_password,
    'HOST': "localhost",
    'PORT': local_port, # 远程数据库映射到本地的端口
    'OPTIONS': {'init_command': 'SET default_storage_engine=INNODB;'}
    }
    }

至此,在使用Django的model时,将通过ssh隧道访问远程数据库

注意事项

  1. 事先了解迁徙数据量,并且取5%~10%的数据测试迁徙速度
  2. 由测试数据预估总迁徙用时,如果总迁徙用时大于一小时,一定要把迁徙脚本放到服务器运行,这样迁徙过程不易中断,且服务器性能远比个人电脑更优
  3. 尽量使用批量插入减少写数据库的次数,使用cursor.executemany或者Django的bulk_create
  4. 迁徙过程要写好log,这样能够知道数据迁徙到了哪一步,如意外终端也能找到断点继续运行
  5. 创建时间字段加上auto_add_now会自动记录数据的创建时间,在插入数据的时候对这个字段赋值无效

mysql数据迁徙详解的更多相关文章

  1. MySQL 联合索引详解

    MySQL 联合索引详解   联合索引又叫复合索引.对于复合索引:Mysql从左到右的使用索引中的字段,一个查询可以只使用索引中的一部份,但只能是最左侧部分.例如索引是key index (a,b,c ...

  2. MySQL关闭过程详解和安全关闭MySQL的方法

    MySQL关闭过程详解和安全关闭MySQL的方法 www.hongkevip.com 时间: -- : 阅读: 整理: 红客VIP 分享到: 红客VIP(http://www.hongkevip.co ...

  3. 【转】Nginx+php-fpm+MySQL分离部署详解

    转:http://www.linuxidc.com/Linux/2015-07/120580.htm Nginx+php-fpm+MySQL分离部署详解 [日期:2015-07-26] 来源:Linu ...

  4. Mysql加锁过程详解(8)-理解innodb的锁(record,gap,Next-Key lock)

    Mysql加锁过程详解(1)-基本知识 Mysql加锁过程详解(2)-关于mysql 幻读理解 Mysql加锁过程详解(3)-关于mysql 幻读理解 Mysql加锁过程详解(4)-select fo ...

  5. Mysql加锁过程详解(9)-innodb下的记录锁,间隙锁,next-key锁

    Mysql加锁过程详解(1)-基本知识 Mysql加锁过程详解(2)-关于mysql 幻读理解 Mysql加锁过程详解(3)-关于mysql 幻读理解 Mysql加锁过程详解(4)-select fo ...

  6. Mysql加锁过程详解(1)-基本知识

    Mysql加锁过程详解(1)-基本知识 Mysql加锁过程详解(2)-关于mysql 幻读理解 Mysql加锁过程详解(3)-关于mysql 幻读理解 Mysql加锁过程详解(4)-select fo ...

  7. Mysql加锁过程详解(2)-关于mysql 幻读理解

    Mysql加锁过程详解(1)-基本知识 Mysql加锁过程详解(2)-关于mysql 幻读理解 Mysql加锁过程详解(3)-关于mysql 幻读理解 Mysql加锁过程详解(4)-select fo ...

  8. Mysql加锁过程详解(3)-关于mysql 幻读理解

    Mysql加锁过程详解(1)-基本知识 Mysql加锁过程详解(2)-关于mysql 幻读理解 Mysql加锁过程详解(3)-关于mysql 幻读理解 Mysql加锁过程详解(4)-select fo ...

  9. Mysql加锁过程详解(4)-select for update/lock in share mode 对事务并发性影响

    Mysql加锁过程详解(1)-基本知识 Mysql加锁过程详解(2)-关于mysql 幻读理解 Mysql加锁过程详解(3)-关于mysql 幻读理解 Mysql加锁过程详解(4)-select fo ...

随机推荐

  1. DocumentFormat.OpenXml read excel file

    这里向大家介绍一种读取excel 数据的方法,用的是DoucmentFormat.OpenXml.dll 废话不多说,向大家展示一下在项目中处理过的方法,如果有任何疑问,随时联系我. using Do ...

  2. 阿里云ESC服务器centos6.9使用及注意事项

    阿里云ESC服务器,配置低,但是足够新手尝试操作练习. 使用之前,注意事项: 选择操作系统 设置实例快照 安装终端工具 一,选择操作系统. 可以在购买服务器的时候进行选择系统盘,也可以在购买之后在实例 ...

  3. Java 爬虫遇上数据异步加载,试试这两种办法!

    这是 Java 爬虫系列博文的第三篇,在上一篇 Java 爬虫遇到需要登录的网站,该怎么办? 中,我们简单的讲解了爬虫时遇到登录问题的解决办法,在这篇文章中我们一起来聊一聊爬虫时遇到数据异步加载的问题 ...

  4. idea中的java web项目(添加jar包介绍)和java maven web项目目录结构

    java web项目 web项目下web根目录名称是可以更改的 idea中新建java web项目,默认src为Sources Root,当然也可以手动改,在Sources Root下右键只能新建Pa ...

  5. json.dumps和json.loads

    概念理解 1.json.dumps()和json.loads()是json格式处理函数(可以这么理解,json是字符串) (1)json.dumps()函数是将一个Python数据类型列表进行json ...

  6. 深入理解C#多线程 -戈多编程

    引用(http://www.cnblogs.com/luxiaoxun/p/3280146.html) 一.使用线程的好处   1.可以使用线程将代码同其他代码隔离,提高应用程序的可靠性. 2.可以使 ...

  7. Spring Cloud之Zuul

    API网关是一个更为智能的应用服务器,它的存在就像是整个微服务架构系统的门面一样,所有的外部客户端访问都需要经过它来进行调度和过滤.它除了要实现请求路由.负载均衡.校验过滤等功能之外,还需要更多能力, ...

  8. python程序调用C/C++代码

    这篇用来记录在些模拟Canoe生成CAN数据桢工具时遇到的问题, 生成CAN数据桢,主要分为两个关注点: 1.如何从can信号名获取到can信号的ID长度以及信号的起始位,并将信号值按照一定的规则填写 ...

  9. vue中图片放大镜功能

    仿淘宝详情页图片鼠标移过去可对图片放大显示在右侧 效果图如下图,此功能支持PC端与移动端 接下来进入代码实现环节: 先准备两张图片,一张小图片叫 '土味.jpg',大小160*91:一张大图片叫 ' ...

  10. 一张图一个题帮你迅速理解RLU算法

    下面是某年的软考题: 某进程页面访问序列为4,2,3,1,2,4,5,3,1,2,3,5,且开始执行时内存中没有页面,分配给该进程的物理块数是3,则采用RLU页面置换算法时的缺页率是多少? 对于这个问 ...