经历了前两轮优化之后,saiku由不可使用,优化到可以使用,不过在分析大量日志数据的时候,还有顿卡的感觉!继续观察背后执行的Sql,决定将注意力关注到索引上面!

日志的主要使用场景是:固定日期维度的数据分析,也就是说where条件一定跟着日期等于某一天,那么纠结的是:每个字段都建立索引,还是和日期建立联合索引。归结到底就是单个字段的索引效率与联合索引的效率优劣对比!

Postgresql数据表:saiku_search_detail

表结构:

CREATE TABLE test.saiku_search_detail
(
rpt_date date,
from_area_id bigint,
from_value_id bigint,
in_track_id bigint,
gid character varying,
current_city_id bigint,
dist_city_id bigint,
category_name_id bigint,
page_id bigint,
utmr_page_id bigint,
num bigint,
id bigint,
partner smallint
)

条数:8,510,490。大概851万

测试步骤:

一、裸表

对一个日期进行查询:

1.1 单个条件

select
count(1)
from test.saiku_search_detail
where rpt_date = '2016-05-13'

结果:1110ms

"Aggregate  (cost=160934.85..160934.86 rows=1 width=0)"
" -> Seq Scan on saiku_search_detail (cost=0.00..160816.78 rows=47230 width=0)"
" Filter: (rpt_date = '2016-05-13'::date)"

1.2 两个条件

select
count(1)
from test.saiku_search_detail
where rpt_date = '2016-05-13'
and from_area_id = 135

结果:1782ms

"Aggregate  (cost=184432.32..184432.33 rows=1 width=0)"
" -> Seq Scan on saiku_search_detail (cost=0.00..184431.73 rows=236 width=0)"
" Filter: ((rpt_date = '2016-05-13'::date) AND (from_area_id = 135))"

没有任何异议,0个索引!

二、对两个字段分别添加索引:

--btree索引
CREATE INDEX saiku_search_detail_from_area_id_idx
ON saiku_search_detail
USING btree
(from_area_id);
--hash索引
CREATE INDEX saiku_search_detail_rpt_date_idx
ON saiku_search_detail
USING hash
(rpt_date);

2.1 单个条件

select
count(1)
from saiku_search_detail
where rpt_date = '2016-05-13'

结果:83ms

"Aggregate  (cost=8.02..8.03 rows=1 width=0)"
" -> Index Scan using saiku_search_detail_rpt_date_idx on saiku_search_detail (cost=0.00..8.02 rows=1 width=0)"
" Index Cond: (rpt_date = '2016-05-13'::date)"

使用了索引

2.2 两个条件

select
count(1)
from saiku_search_detail
where rpt_date = '2016-05-13'
and from_area_id = 135

结果:149ms

"Aggregate  (cost=8.02..8.03 rows=1 width=0)"
" -> Index Scan using saiku_search_detail_rpt_date_idx on saiku_search_detail (cost=0.00..8.02 rows=1 width=0)"
" Index Cond: (rpt_date = '2016-05-13'::date)"
" Filter: (from_area_id = 135)"

使用了一个索引,第二个索引没有生效。尝试修改sql的条件顺序:

select
count(1)
from saiku_search_detail
where from_area_id = 135
and rpt_date = '2016-05-13'

结果一样!这说明在Postgresql里面,建立两个索引字段,只会一个起作用!

三、建立联合索引

--复合索引,两个字段都添加索引
CREATE INDEX saiku_search_detail_rpt_date_from_area_idx
ON test.saiku_search_detail
USING btree
(rpt_date, from_area_id);

3.1 单个条件查询&建立索引的第一个字段

select
count(1)
from test.saiku_search_detail
where rpt_date = '2016-05-13'

结果:66ms

"Aggregate  (cost=47843.00..47843.01 rows=1 width=0)"
" -> Bitmap Heap Scan on saiku_search_detail (cost=2220.63..47362.94 rows=192025 width=0)"
" Recheck Cond: (rpt_date = '2016-05-13'::date)"
" -> Bitmap Index Scan on saiku_search_detail_rpt_date_from_area_idx (cost=0.00..2172.62 rows=192025 width=0)"

可见使用了部分索引

3.2 两个条件查询

select
count(1)
from test.saiku_search_detail
where rpt_date = '2016-05-13'
and from_area_id = 135

结果:65ms

"Aggregate  (cost=46124.99..46125.00 rows=1 width=0)"
" -> Bitmap Heap Scan on saiku_search_detail (cost=1509.67..45857.37 rows=107047 width=0)"
" Recheck Cond: ((rpt_date = '2016-05-13'::date) AND (from_area_id = 135))"
" -> Bitmap Index Scan on saiku_search_detail_rpt_date_from_area_idx (cost=0.00..1482.90 rows=107047 width=0)"

使用了索引

总结

  • 废话:如果两个字段做为筛选条件,那么联合索引最优。
  • 收益:在日志分析过程中,除了日期的单个字段做为索引,其他的单个字段索引都不起作用,应该删除
  • 纠结:仅仅在日期建立单个索引,还是建立多个包含日期的复合索引?根据使用场景自己决定吧

saiku之行速度优化(三)的更多相关文章

  1. 【SQL server初级】数据库性能优化三:程序操作优化

    数据库优化包含以下三部分,数据库自身的优化,数据库表优化,程序操作优化.此文为第三部分 数据库性能优化三:程序操作优化 概述:程序访问优化也可以认为是访问SQL语句的优化,一个好的SQL语句是可以减少 ...

  2. dWebpack编译速度优化实战

    当你的应用的规模还很小时,你可能不会在乎Webpack的编译速度,无论使用3.X还是4.X版本,它都足够快,或者说至少没让你等得不耐烦.但随着业务的增多,嗖嗖嗖一下项目就有上百个组件了,也是件很简单的 ...

  3. MySQL优化三(InnoDB优化)

    body { font-family: Helvetica, arial, sans-serif; font-size: 14px; line-height: 1.6; padding-top: 10 ...

  4. Tone Mapping算法系列二:一种自适应对数映射的高对比度图像显示技术及其速度优化。

    办公室今天停电,幸好本本还有电,同事们好多都去打麻将去了,话说麻将这东西玩起来也还是有味的,不过我感觉我是输了不舒服,赢了替输的人不舒服,所以干脆拜别麻坛四五年了,在办公室一个人整理下好久前的一片论文 ...

  5. App架构师实践指南六之性能优化三

    App架构师实践指南六之性能优化三 2018年08月02日 13:57:57 nicolelili1 阅读数:190   内存性能优化1.内存机制和原理 1.1 内存管理内存时一个基础又高深的话题,从 ...

  6. MySQL性能优化(三):索引

    原文:MySQL性能优化(三):索引 版权声明:本文为博主原创文章,遵循CC 4.0 BY-SA版权协议,转载请附上原文出处链接和本声明. 本文链接:https://blog.csdn.net/vbi ...

  7. [转]Asp.net mvc 网站之速度优化 -- 页面缓存

    网站速度优化的一般方法 由于网站最重要的用户体验就是速度,特别是对于电子商务网站而言. 一般网站速度优化会涉及到几个方面: 1. 数据库优化 — 查询字段简历索引,使用数据库连接池和持久化,现在还有种 ...

  8. web访问速度优化分析

    请求从发出到接收完成一共经历了DNS Lookup.Connecting.Blocking.Sending.Waiting和Receiving六个阶段,时间共计38ms.请求完成之后是DOM加载和页面 ...

  9. 记一次cocos项目的加载速度优化

    半个月前,我们用cosos creator做了一个简单的小游戏,也许算不上小游戏吧..一边学cocos,一边做,几经波折后终于上线了.然鹅,功能是实现了,但是加载速度十分感人(毕竟没经验嘛,无辜脸). ...

随机推荐

  1. Javah提示未找到 ..的类文件

    D:\我的文档\workspace\PrepareForExam\src>javah -classpath D:\我的文档\workspace\ PrepareForExam\src\com\e ...

  2. 实验五 含有控制信号的计数器VHDL设计

    一.实验目的 学习计数器的设计.仿真和硬件测试,进一步熟悉VHDL设计技术. 二.实验仪器与器材 计算机1台,GW48-PK2S实验箱1台,QuartusⅡ6.0 1套. 三.实验 1. 基本命题 在 ...

  3. HTML5 Canvas实现黑客帝国文字掉落效果

    效果: 原理: 用canvas逐行输出文字,然后让背景颜色逐渐加深,再随机中断某些列. 代码: HTML: <canvas id="c"></canvas> ...

  4. HTTP权威指南阅读笔记二:URL与资源

    URL中的限制字符: 在URL中,有几个字符被保留起来,有着特殊的含义.有些字符不在定义的US-ASCII可打印字符集中.还有些字符会与某些因特网网关和协议产生混淆,因此不赞成使用. 下面这些字符是U ...

  5. [ACM_其他] 总和不小于S的连续子序列的长度的最小值——尺缩法

    Description: 给定长度为n的整数数列,A[0],A[1],A[2]….A[n-1]以及整数S,求出总和不小于S的连续子序列的长度的最小值.如果解不存在,则输出0. Input: 输入数据有 ...

  6. Html 字体大小单位 px em pt

    网页上定义字体大小有常见三种单位,px.em.pt px px是pixel缩写,是基于像素的单位.在浏览网页过程中,屏幕上的文字.图片等会随屏幕的分辨率变化而变化,一个100px宽度大小的图片,在80 ...

  7. 《区块链:从入门到放弃》之obc安装步骤

    obc安装步骤 朋友们可能会好奇,厨师不研究菜谱怎么改研究兵法了,哈哈,我原本是app出身,最近被安排去预研区块链和比特币技术,2个月下来,颇有斩获.期间得到IBM的CC同学指导我一步一步安装obc的 ...

  8. C语言实现单链表-03版

    在C语言实现单链表-02版中我们只是简单的更新一下链表的组织方式: 它没有更多的更新功能,因此我们这个版本将要完成如下功能: Problem 1,搜索相关节点: 2,前插节点: 3,后追加节点: 4, ...

  9. JNI技术基础(1)——从零开始编写JNI代码

    众所周知,Java程序的最大特点就是其跨平台的特性,编写的上层应用程序可以不加任何修改甚至不用重新编译而运行于不同的平台上,然而,Java本身也存着这一个弊端,那就是性能上相对要差一些,在对性能要求比 ...

  10. javaweb学习总结(八)——HttpServletResponse对象(二)

    一.HttpServletResponse常见应用——生成验证码 1.1.生成随机图片用作验证码 生成图片主要用到了一个BufferedImage类,