数据切分——Mysql分区表的建立及性能分析

Mysql的安装方法可以参考：

http://blog.csdn.net/jhq0113/article/details/43812895

Mysql分区表的介绍可以参考：

http://blog.csdn.net/jhq0113/article/details/44592865

1.检查你的Mysql是否支持分区

mysql> SHOW VARIABLES LIKE '%partition%';

若结果如下，表示你的Mysql支持表分区:

+-----------------------+-------+

       | Variable_name         | Value |

       +-----------------------+-------+

       | have_partition_engine | YES   |

       +-----------------------+-------+

       1 row in set (0.00 sec)

RANGE分区表创建方式：

DROP TABLE IF EXISTS `my_orders`;

CREATE TABLE `my_orders` (

  `id` int(10) unsigned NOT NULL AUTO_INCREMENT COMMENT '表主键',

  `pid` int(10) unsigned NOT NULL COMMENT '产品ID',

  `price` decimal(15,2) NOT NULL COMMENT '单价',

  `num` int(11) NOT NULL COMMENT '购买数量',

  `uid` int(10) unsigned NOT NULL COMMENT '客户ID',

  `atime` datetime NOT NULL COMMENT '下单时间',

  `utime` int(10) unsigned NOT NULL DEFAULT 0 COMMENT '修改时间',

  `isdel` tinyint(4) NOT NULL DEFAULT '0' COMMENT '软删除标识',

  PRIMARY KEY (`id`,`atime`)

) ENGINE=InnoDB DEFAULT CHARSET=utf8

/*********分区信息**************/

PARTITION BY RANGE (YEAR(atime))

(

   PARTITION p0 VALUES LESS THAN (2016),

   PARTITION p1 VALUES LESS THAN (2017),

   PARTITION p2 VALUES LESS THAN MAXVALUE

);

以上是一个简单的订单表，分区字段是atime,根据RANGE分区，这样当你向该表中插入数据的时候，Mysql会根据YEAR(atime)的值进行分区存储。

检查分区是否创建成功，执行查询语句：

EXPLAIN PARTITIONS SELECT * FROM `my_orders`

若成功，结果如下：

性能分析：

1）.创建同样表结构，但没有进行分区的表

DROP TABLE IF EXISTS `my_order`;

CREATE TABLE `my_order` (

  `id` int(10) unsigned NOT NULL AUTO_INCREMENT COMMENT '表主键',

  `pid` int(10) unsigned NOT NULL COMMENT '产品ID',

  `price` decimal(15,2) NOT NULL COMMENT '单价',

  `num` int(11) NOT NULL COMMENT '购买数量',

  `uid` int(10) unsigned NOT NULL COMMENT '客户ID',

  `atime` datetime NOT NULL COMMENT '下单时间',

  `utime` int(10) unsigned NOT NULL DEFAULT 0 COMMENT '修改时间',

  `isdel` tinyint(4) NOT NULL DEFAULT '0' COMMENT '软删除标识',

  PRIMARY KEY (`id`,`atime`)

) ENGINE=InnoDB DEFAULT CHARSET=utf8;

2）.向两张表中插入相同的数据

/**************************向分区表插入数据****************************/

INSERT INTO my_orders(`pid`,`price`,`num`,`uid`,`atime`) VALUES(1,12.23,1,89757,CURRENT_TIMESTAMP());

INSERT INTO my_orders(`pid`,`price`,`num`,`uid`,`atime`) VALUES(1,12.23,1,89757,'2016-05-01 00:00:00');

INSERT INTO my_orders(`pid`,`price`,`num`,`uid`,`atime`) VALUES(1,12.23,1,89757,'2017-05-01 00:00:00');

INSERT INTO my_orders(`pid`,`price`,`num`,`uid`,`atime`) VALUES(1,12.23,1,89757,'2018-05-01 00:00:00');

INSERT INTO my_orders(`pid`,`price`,`num`,`uid`,`atime`) VALUES(1,12.23,1,89756,'2015-05-01 00:00:00');

INSERT INTO my_orders(`pid`,`price`,`num`,`uid`,`atime`) VALUES(1,12.23,1,89756,'2016-05-01 00:00:00');

INSERT INTO my_orders(`pid`,`price`,`num`,`uid`,`atime`) VALUES(1,12.23,1,89756,'2017-05-01 00:00:00');

INSERT INTO my_orders(`pid`,`price`,`num`,`uid`,`atime`) VALUES(1,12.23,1,89756,'2018-05-01 00:00:00');

/**************************向未分区表插入数据****************************/

INSERT INTO my_order(`pid`,`price`,`num`,`uid`,`atime`) VALUES(1,12.23,1,89757,CURRENT_TIMESTAMP());

INSERT INTO my_order(`pid`,`price`,`num`,`uid`,`atime`) VALUES(1,12.23,1,89757,'2016-05-01 00:00:00');

INSERT INTO my_order(`pid`,`price`,`num`,`uid`,`atime`) VALUES(1,12.23,1,89757,'2017-05-01 00:00:00');

INSERT INTO my_order(`pid`,`price`,`num`,`uid`,`atime`) VALUES(1,12.23,1,89757,'2018-05-01 00:00:00');

INSERT INTO my_order(`pid`,`price`,`num`,`uid`,`atime`) VALUES(1,12.23,1,89756,'2015-05-01 00:00:00');

INSERT INTO my_order(`pid`,`price`,`num`,`uid`,`atime`) VALUES(1,12.23,1,89756,'2016-05-01 00:00:00');

INSERT INTO my_order(`pid`,`price`,`num`,`uid`,`atime`) VALUES(1,12.23,1,89756,'2017-05-01 00:00:00');

INSERT INTO my_order(`pid`,`price`,`num`,`uid`,`atime`) VALUES(1,12.23,1,89756,'2018-05-01 00:00:00');

3）.主从复制，大约20万条左右（主从复制的数据和真实环境有差距，但是能体现出表分区查询的性能优劣）

/**********************************主从复制大量数据******************************/

INSERT INTO `my_orders`(`pid`,`price`,`num`,`uid`,`atime`) SELECT `pid`,`price`,`num`,`uid`,`atime` FROM `my_orders`;

INSERT INTO `my_order`(`pid`,`price`,`num`,`uid`,`atime`) SELECT `pid`,`price`,`num`,`uid`,`atime` FROM `my_order`;

4）.查询测试

/***************************查询性能分析**************************************/

SELECT * FROM `my_orders` WHERE `uid`=89757 AND `atime`< CURRENT_TIMESTAMP();

/****用时0.084s****/

SELECT * FROM `my_order` WHERE `uid`=89757 AND `atime`< CURRENT_TIMESTAMP();

/****用时0.284s****/

通过以上查询可以明显看出进行表分区的查询性能更好，查询所花费的时间更短。

分析查询过程：

EXPLAIN PARTITIONS SELECT * FROM `my_orders` WHERE `uid`=89757 AND `atime`< CURRENT_TIMESTAMP();

EXPLAIN PARTITIONS SELECT * FROM `my_order` WHERE `uid`=89757 AND `atime`< CURRENT_TIMESTAMP();

通过以上结果可以看出，my_orders表查询直接经过p0分区，只扫描了49386行，而my_order表没有进行分区，扫描了196983行，这也是性能得到提升的关键所在。

当然，表的分区并不是分的越多越好，当表的分区太多时找分区又是一个性能的瓶颈了，建议在200个分区以内。

LIST分区表创建方式：

/*****************创建分区表*********************/

CREATE TABLE `products` (

`id`  bigint UNSIGNED NOT NULL AUTO_INCREMENT COMMENT '表主键' ,

`name`  varchar(64) CHARACTER SET utf8 COLLATE utf8_general_ci NOT NULL COMMENT '产品名称' ,

`metrial`  tinyint UNSIGNED NOT NULL COMMENT '材质' ,

`weight`  double UNSIGNED NOT NULL DEFAULT 0 COMMENT '重量' ,

`vol`  double UNSIGNED NOT NULL DEFAULT 0 COMMENT '容积' ,

`c_id`  tinyint UNSIGNED NOT NULL COMMENT '供货公司ID' ,

PRIMARY KEY (`id`,`c_id`)

)ENGINE=InnoDB DEFAULT CHARSET=utf8

/*********分区信息**************/

PARTITION BY LIST(c_id)

(

    PARTITION pA VALUES IN (1,3,11,13),

    PARTITION pB VALUES IN (2,4,12,14),

    PARTITION pC VALUES IN (5,7,15,17),

    PARTITION pD VALUES IN (6,8,16,18),

    PARTITION pE VALUES IN (9,10,19,20)

);

可以看出，LIST分区和RANGE分区很类似，这里就不做性能分析了，和RANGE很类似。

HASH分区表的创建方式：

/*****************分区表*****************/

CREATE TABLE `msgs` (

  `id` bigint(20) unsigned NOT NULL AUTO_INCREMENT COMMENT '表主键',

  `sender` int(10) unsigned NOT NULL COMMENT '发送者ID',

  `reciver` int(10) unsigned NOT NULL COMMENT '接收者ID',

  `msg_type` tinyint(3) unsigned NOT NULL COMMENT '消息类型',

  `msg` varchar(225) NOT NULL COMMENT '消息内容',

  `atime` int(10) unsigned NOT NULL COMMENT '发送时间',

  `sub_id` tinyint(3) unsigned NOT NULL COMMENT '部门ID',

  PRIMARY KEY (`id`,`sub_id`)

) ENGINE=InnoDB DEFAULT CHARSET=utf8

/*********分区信息**************/

PARTITION BY HASH(sub_id)

PARTITIONS 10;

以上语句代表，msgs表按照sub_id进行HASH分区，一共分了十个区。

Key分区和HASH分区很类似，不再介绍，若想了解可以参考Mysql官方文档进行详细了解。

子分区的创建方式:

CREATE TABLE `msgss` (

  `id` bigint(20) unsigned NOT NULL AUTO_INCREMENT COMMENT '表主键',

  `sender` int(10) unsigned NOT NULL COMMENT '发送者ID',

  `reciver` int(10) unsigned NOT NULL COMMENT '接收者ID',

  `msg_type` tinyint(3) unsigned NOT NULL COMMENT '消息类型',

  `msg` varchar(225) NOT NULL COMMENT '消息内容',

  `atime` int(10) unsigned NOT NULL COMMENT '发送时间',

  `sub_id` tinyint(3) unsigned NOT NULL COMMENT '部门ID',

  PRIMARY KEY (`id`,`atime`,`sub_id`)

) ENGINE=InnoDB DEFAULT CHARSET=utf8

/*********分区信息**************/

PARTITION BY RANGE (atime) SUBPARTITION BY HASH (sub_id)

(

		PARTITION t0 VALUES LESS THAN(1451577600)

		(

			SUBPARTITION s0,

			SUBPARTITION s1,

			SUBPARTITION s2,

			SUBPARTITION s3,

			SUBPARTITION s4,

			SUBPARTITION s5

		),

		PARTITION t1 VALUES LESS THAN(1483200000)

		(

			SUBPARTITION s6,

			SUBPARTITION s7,

			SUBPARTITION s8,

			SUBPARTITION s9,

			SUBPARTITION s10,

			SUBPARTITION s11

		),

		PARTITION t2 VALUES LESS THAN MAXVALUE

		(

			SUBPARTITION s12,

			SUBPARTITION s13,

			SUBPARTITION s14,

			SUBPARTITION s15,

			SUBPARTITION s16,

			SUBPARTITION s17

		)

);

检查子分区是否创建成功：

EXPLAIN PARTITIONS SELECT * FROM msgss;

结果如下图：

数据切分——Mysql分区表的建立及性能分析的更多相关文章

数据切分——Mysql分区表的管理与维护
关于Mysql分区表的介绍可以参考: http://blog.csdn.net/jhq0113/article/details/44592865 关于Mysql分区表的创建可以参考: http://b ...
MYSQL索引结构原理、性能分析与优化
[转]MYSQL索引结构原理.性能分析与优化第一部分:基础知识索引官方介绍索引是帮助MySQL高效获取数据的数据结构.笔者理解索引相当于一本书的目录,通过目录就知道要的资料在哪里, 不用一页一页 ...
Mysql视图的作用及其性能分析
定义:视图是从一个或几个基本表导出的表,它与基本表不同,是一个虚表. 作用: 1.简化操作,不用进行多表查询. 2.当不同种类的用用户共享同一个数据库时,非常灵活,(用户以不同的方式看待同一数据. ...
【转】由浅入深探究mysql索引结构原理、性能分析与优化
摘要: 第一部分:基础知识第二部分:MYISAM和INNODB索引结构 1.简单介绍B-tree B+ tree树 2.MyisAM索引结构 3.Annode索引结构 4.MyisAM索引与Inno ...
由浅入深探究mysql索引结构原理、性能分析与优化转
第一部分:基础知识第二部分:MYISAM和INNODB索引结构 1. 简单介绍B-tree B+ tree树 2. MyisAM索引结构 3. Annode索引结构 4. MyisAM索引与Inno ...
由浅入深探究mysql索引结构原理、性能分析与优化
摘要: 第一部分:基础知识第二部分:MYISAM和INNODB索引结构 1.简单介绍B-tree B+ tree树 2.MyisAM索引结构 3.Annode索引结构 4.MyisAM索引与Inno ...
[转载]由浅入深探究mysql索引结构原理、性能分析与优化
第一部分:基础知识第二部分:MYISAM和INNODB索引结构1. 简单介绍B-tree B+ tree树 2. MyisAM索引结构 3. Annode索引结构 4. MyisAM索引与InnoDB ...
Mysql Join语法解析与性能分析详解
一．Join语法概述 join 用于多表中字段之间的联系,语法如下: ... FROM table1 INNER|LEFT|RIGHT JOIN table2 ON conditiona table1 ...
[转]Mysql Join语法解析与性能分析
转自:http://www.cnblogs.com/BeginMan/p/3754322.html 一．Join语法概述 join 用于多表中字段之间的联系,语法如下: ... FROM table1 ...

随机推荐

linux 下手动编译安装无线网卡驱动
先参照 <本地yum源安装GCC >安装好gcc hp的笔记本上安装了CentOS6.3,没有安装无线网卡驱动,安装这个驱动,在Google上找了好多资料,最后终于解决了这个问题.在这里做 ...
bootstrap 智能表单 demo示例
1.基本配置,支持的元素类型 2.自动布局 3.自定义布局 4.自定义表单 5.数据绑定 6.带验证的表单 7.智能搜索 8.级联下拉 9.图片上传图片有点大了,屏幕不够大的话可能看的不习惯,没事 ...
jQeury学习笔记
jQuery 语法: 核心语法: $(selector).action() 美元符号定义 jQuery 选择符(selector)"查询"和"查找" HTML ...
eclipse或adt-bundle创建的android项目没有自动生成MainActivity.java和activity_main.xml等文件解决办法
以前我电脑一直以来都是用的eclipse3.7来开发android项目的,创建android项目也能正常生成MainActivity.java和activity_main.xml等文件.后来不知道什么 ...
Webform之FileUpload(上传按钮控件)简单介绍及下载、上传文件时图片预览
1.FileUpload上传控件:(原文:http://www.cnblogs.com/hide0511/archive/2006/09/24/513201.html) FileUpload 控件显示 ...
SQL SERVER 2008 R2 自动备份并删除过期备份数据
我们的系统维护的过程中肯定需要对数据库进行定期的备份,但是如果定时手工备份的话,不但浪费时间,也不能保证每次都可以按时备份,所以自动备份成为了我们的不二选择,但是定时备份需要定期清理备份文件, ...
mysql 本机root密码忘记
1.找到对应的my.conf,在mysqld节点添加:skip-grant-tables 2.重启mysql 即可无密登录 3.update user表中的密码后,去除skip-grant-tabl ...
[LeetCode]题解（python）：075-Sort Colors
题目来源: https://leetcode.com/problems/sort-colors/ 题意分析: 给定n个颜色,红色,白色和蓝色.分别用0,1,2代替,将这些颜色排序,0在1前,1在2前. ...
帝国cms7.2灵动标签万能教程
学完本文,就完全能掌握帝国模板开发制作啦!这里只介绍sql语句调用方法(方便,快捷!) 灵动标签语法: [e:loop={,24,0}] 模板内容 [/e:loop] 详细解释:黄色部分:条件语句,即 ...
Session（）
如何使用 Session Java Api 只给我们一种方式来获取当前会话相关的 session: HttpSession session = request.getSession(); //或 ...

数据切分——Mysql分区表的建立及性能分析

数据切分——Mysql分区表的建立及性能分析的更多相关文章

随机推荐

热门专题