Facebook对MySQL全表扫描性能的改进

原文博客如下：

http://yoshinorimatsunobu.blogspot.com/2013/10/making-full-table-scan-10x-faster-in.html

如下是读博客做的笔记：

Facebook对全表扫描的需求场景：

1.logical backups(eg: mysqldump);

2.online schema changes(eg: SELECT... INTO OUTFILE);

Facebook 使用logical backups(vs physical backup)的原因：

1.size is mush smaller(3x ~10 x);

2.eaier to parse backups;

drawbacks of logical backup:

full backup and full restore are much slower than physical backup/restore.

如果数据库大时，表一般都是fragmented，此时InnoDB的全表扫描是随机读而非顺序读。

Logical Readahead即为实现InnoDB全表扫描时的顺序读。

给出的性能提升数据：

1. 9~10 times faster under usual production workloads

2. 15~20 times faster under heavy production workloads

在HDD上效果明显。

InnoDB已经支持的prefetching feature "Linear Read Ahead"对提升全表扫描的性能并没有什么帮助，因为Linear Read Ahead是按照磁盘物理的page顺序做prefetch(默认64个page，这个范围太小了)。而稍大些的fragmented tables，逻辑上相邻的两个page在物理上距离一般会更大（文章中举例 page 3 -> page 5230 -> page 4）.

Logical Read Ahead基本原理：

根据primary key的B+树的branch节点记录的leaf page number信息，按照page的顺序（大部分转化为顺序读）将很多leaf节点的数据读入buffer pool，提升后续全表扫描时buffer pool的命中率，进而避免随机读。

实现思路（步骤）：

1.Reading many branch pages of the primary key

2.Collecting leaf page numbers

3.Reading many (configurable amount of) leaf pages by page number order (mostly sequential disk reads)

4.Reading rows by primary key order (same as usual full table scan, but buffer pool hit rate should be very high)

提供两个新的session variables:

1. innodb_lra_size; (the size of prefetch leaf pages)

2. innodb_lra_sleep; (???做啥用的？？？)

在需要使用LRA时将这个特性打开。

Submitting multiple async I/O requests at once

In 5.6, InnoDB开始默认使用aio。将多个连续的16KB读取一次submit，可以利用Linux对多个请求的merge，提高效率。

在HDD Raid 1+0的条件下，作者每次提交64个连续页面的读取请求，将读取效率由160MB/s提升至1000ＭＢ/s.

测试数据如下：

1. Full table scan on pure HDD (basic benchmark, no other workload)

Table size	Without LRA	With LRA	Improvement
10GB	10 min 55.00 sec	1 min 15.20 sec	8.71x
50GB	52 min 44.42 sec	6 min 36.98 sec	7.97x

2. Online schema change under heavy workload

Table size	Without LRA	With LRA	Improvement
1GB	7 min 33 sec	24 sec	18.8x

关于上述改进的三处改动都给了patch。

Facebook对MySQL全表扫描性能的改进的更多相关文章

MYSQl 全表扫描以及查询性能
MYSQl 全表扫描以及查询性能 -- 本文章仅用于学习,记录一. Mysql在一些情况下全表检索比索引查询更快: 1.表格数据很少,使用全表检索会比使用索引检索更快.一般当表格总数据小于10行并且 ...
造成MySQL全表扫描的原因
全表扫描是数据库搜寻表的每一条记录的过程,直到所有符合给定条件的记录返回为止.通常在数据库中,对无索引的表进行查询一般称为全表扫描:然而有时候我们即便添加了索引,但当我们的SQL语句写的不合理的时候也 ...
mysql 全表扫描、全索引扫描、索引覆盖(覆盖索引)
full index scan:全索引扫描,查询时,遍历索引树来获取数据行.如果数据不是密集的会产生随机IO 在执行计划中是Type列,index full table scan:通过读物理表获取数据 ...
mysql 全表扫描场景
全表扫描是数据库搜寻表的每一条记录的过程,直到所有符合给定条件的记录返回为止.通常在数据库中,对无索引的表进行查询一般称为全表扫描:然而有时候我们即便添加了索引,但当我们的SQL语句写的不合理的时候也 ...
MySql避免全表扫描【转】
原文地址:http://blog.163.com/ksm19870304@126/blog/static/37455233201251901943705/ 对查询进行优化,应尽量避免全表扫描,首先应考 ...
Mysql避免全表扫描sql查询优化 .
对查询进行优化,应尽量避免全表扫描,首先应考虑在 where 及 order by 涉及的列上建立索引: .尝试下面的技巧以避免优化器错选了表扫描: · 使用ANALYZE TABLE tbl_n ...
MySql避免全表扫描
对查询进行优化,应尽量避免全表扫描,首先应考虑在where 及order by 涉及的列上建立索引: .尝试下面的技巧以避免优化器错选了表扫描: · 使用ANALYZE TABLE tbl_name为 ...
Mysql怎么样避免全表扫描，sql查询优化
对查询进行优化,应尽量避免全表扫描,首先应考虑在 where 及 order by 涉及的列上建立索引: 尝试下面的技巧以避免优化器错选了表扫描: 使用ANALYZE TABLE tbl_name为扫 ...
MYSQL的全表扫描，主键索引(聚集索引、第一索引)，非主键索引(非聚集索引、第二索引)，覆盖索引四种不同查询的分析
文章出处:http://inter12.iteye.com/blog/1430144 MYSQL的全表扫描,主键索引(聚集索引.第一索引),非主键索引(非聚集索引.第二索引),覆盖索引四种不同查询的分 ...

随机推荐

deno学习二基本代码
deno 介绍是安全的ts 运行时简单的代码使用js(app.js) console.log("demoapp") 输出 dalongdemo 使用ts(app.ts) con ...
ORA-01033: ORACLE initialization or shutdown in progress --手动删除表空间 DBF 后无法登陆问题
进入CMD,执行set ORACLE_SID=fbms,确保连接到正确的SID: 2.执行sqlplus "/as sysdba" SQL>shutdown immediat ...
【转】ubuntu中没有/etc/inittab文件探究
原文网址:http://blog.csdn.net/gavinr/article/details/6584582 linux 启动时第一个进程是/sbin/init,其主要功能就是软件执行环境,包括系 ...
【白银组】codevs_1011 数的计算
简单而言,就是递归的运用,注意使用全局变量统计cnt,并且注意递归的结束,中间生成的值无需进行输出. http://codevs.cn/problem/1011/ #include<iostre ...
MPEG2-TS音视频同步原理
一.引言MPEG2系统用于视音频同步以及系统时钟恢复的时间标签分别在ES,PES和TS这3个层次中. 在TS 层, TS头信息包含了节目时钟参考PCR(Program Clock Reference ...
黄聪：将自己开发的插件发布到WordPress官方插件站（转）
原文作者:我爱水煮鱼把你的插件发布到 WordPress 官方插件目录是让更多人用到插件的好方法,这样可以让你的插件不仅仅给我们中国人民使用,而且还可以让你的插件给全世界人民使用,想想全世界人民都在 ...
黄聪：利用iframe实现ajax 跨域通信的解决方案（转）
原文:http://www.cnblogs.com/xueming/archive/2013/02/01/crossdomainajax.html 在漫长的前端开发旅途上,无可避免的会接触到ajax, ...
Vue 基本用法
Vue的基本用法模板语法{{ }} 关闭掉 django中提供的模板语法{{ }} 指令系统 v-text v-html v-show和v-if v-bind和v-on v-for v-model ...
【POJ】1062 昂贵的聘礼（最短路）
题目传送门:QWQ 分析最短路显然,但不好搞地位等级..... 地位等级不好搞?那么就暴力.. 枚举我们允许的地位等级,跑最短路. 所以$ n^2logn $出100什么鬼啊,很有迷惑性啊还有4 ...
tomcat https 启用8443加证书
<?xml version='1.0' encoding='utf-8'?> <!-- Licensed to the Apache Software Foundation (ASF ...

Facebook对MySQL全表扫描性能的改进

Facebook对MySQL全表扫描性能的改进的更多相关文章

随机推荐

热门专题