我最新最全的文章都在南瓜慢说 www.pkslow.com，欢迎大家来喝茶！

1 简介

表分区是解决一些因单表过大引用的性能问题的方式，比如某张表过大就会造成查询变慢，可能分区是一种解决方案。一般建议当单表大小超过内存就可以考虑表分区了。PostgreSQL的表分区有三种方式：

Range：范围分区；
List：列表分区；
Hash：哈希分区。

本文通过示例讲解如何进行这三种方式的分区。

2 例讲三种方式

为方便，我们通过Docker的方式启动一个PostgreSQL，可参考：《Docker启动PostgreSQL并推荐几款连接工具》。我们要选择较高的版本，否则不支持Hash分区，命令如下：

docker run -itd \

    --name pkslow-postgres \

    -e POSTGRES_DB=pkslow \

    -e POSTGRES_USER=pkslow \

    -e POSTGRES_PASSWORD=pkslow \

    -p 5432:5432 \

    postgres:13

2.1 Range范围分区

先创建一张表带有年龄，然后我们根据年龄分段来进行分区，创建表语句如下：

CREATE TABLE pkslow_person_r (

    age int not null,

    city varchar not null

) PARTITION BY RANGE (age);

这个语句已经指定了按age字段来分区了，接着创建分区表：

create table pkslow_person_r1 partition of pkslow_person_r for values from (MINVALUE) to (10);

create table pkslow_person_r2 partition of pkslow_person_r for values from (11) to (20);

create table pkslow_person_r3 partition of pkslow_person_r for values from (21) to (30);

create table pkslow_person_r4 partition of pkslow_person_r for values from (31) to (MAXVALUE);

这里创建了四张分区表，分别对应年龄是0到10岁、11到20岁、21到30岁、30岁以上。

接着我们插入一些数据：

insert into pkslow_person_r(age, city) VALUES (1, 'GZ');

insert into pkslow_person_r(age, city) VALUES (2, 'SZ');

insert into pkslow_person_r(age, city) VALUES (21, 'SZ');

insert into pkslow_person_r(age, city) VALUES (13, 'BJ');

insert into pkslow_person_r(age, city) VALUES (43, 'SH');

insert into pkslow_person_r(age, city) VALUES (28, 'HK');

可以看到这里的表名还是pkslow_person_r，而不是具体的分区表，说明对于客户端是无感知的。

我们查询也一样的：

但实际上是有分区表存在的：

而且分区表与主表的字段是一致的。

查询分区表，就只能查到那个特定分区的数据了：

2.2 List列表分区

类似的，列表分区是按特定的值来分区，比较某个城市的数据放在一个分区里。这里不再给出每一步的讲解，代码如下：

-- 创建主表

create table pkslow_person_l (

                          age int not null,

                          city varchar not null

) partition by list (city);

-- 创建分区表

CREATE TABLE pkslow_person_l1 PARTITION OF pkslow_person_l FOR VALUES IN ('GZ');

CREATE TABLE pkslow_person_l2 PARTITION OF pkslow_person_l FOR VALUES IN ('BJ');

CREATE TABLE pkslow_person_l3 PARTITION OF pkslow_person_l DEFAULT;

-- 插入测试数据

insert into pkslow_person_l(age, city) VALUES (1, 'GZ');

insert into pkslow_person_l(age, city) VALUES (2, 'SZ');

insert into pkslow_person_l(age, city) VALUES (21, 'SZ');

insert into pkslow_person_l(age, city) VALUES (13, 'BJ');

insert into pkslow_person_l(age, city) VALUES (43, 'SH');

insert into pkslow_person_l(age, city) VALUES (28, 'HK');

insert into pkslow_person_l(age, city) VALUES (28, 'GZ');

当我们查询第一个分区的时候，只有广州的数据：

2.3 Hash哈希分区

哈希分区是指按字段取哈希值后再分区。具体的语句如下：

-- 创建主表

create table pkslow_person_h (

                          age int not null,

                          city varchar not null

) partition by hash (city);

-- 创建分区表

create table pkslow_person_h1 partition of pkslow_person_h for values with (modulus 4, remainder 0);

create table pkslow_person_h2 partition of pkslow_person_h for values with (modulus 4, remainder 1);

create table pkslow_person_h3 partition of pkslow_person_h for values with (modulus 4, remainder 2);

create table pkslow_person_h4 partition of pkslow_person_h for values with (modulus 4, remainder 3);

-- 插入测试数据

insert into pkslow_person_h(age, city) VALUES (1, 'GZ');

insert into pkslow_person_h(age, city) VALUES (2, 'SZ');

insert into pkslow_person_h(age, city) VALUES (21, 'SZ');

insert into pkslow_person_h(age, city) VALUES (13, 'BJ');

insert into pkslow_person_h(age, city) VALUES (43, 'SH');

insert into pkslow_person_h(age, city) VALUES (28, 'HK');

可以看到创建分区表的时候，我们用了取模的方式，所以如果要创建N个分区表，就要取N取模。

随便查询一张分区表如下：

可以看到同是SZ的哈希值是一样的，肯定会分在同一个分区，而BJ的哈希值取模后也属于同一个分区。

3 总结

本文讲解了PostgreSQL分区的三种方式。

代码请查看：https://github.com/LarryDpk/pkslow-samples

欢迎关注微信公众号<南瓜慢说>，将持续为你更新...

多读书，多分享；多写作，多整理。

示例讲解PostgreSQL表分区的三种方式的更多相关文章

多表连接的三种方式 HASH MERGE NESTED
多表连接的三种方式详解 HASH JOIN MERGE JOIN NESTED LOOP------------------------------------------------------20 ...
多表连接的三种方式详解 hash join、merge join、 nested loop
在多表联合查询的时候,如果我们查看它的执行计划,就会发现里面有多表之间的连接方式.多表之间的连接有三种方式:Nested Loops,Hash Join 和 Sort Merge Join.具体适用哪 ...
Python - Django - ORM 多对多表结构的三种方式
多对多的三种方式: ORM 自动创建第三张表自己创建第三张表, 利用外键分别关联作者和书,关联查询比较麻烦,因为没办法使用 ORM 提供的便利方法自己创建第三张表,使用 ORM 的 ManyToM ...
python 获取表单的三种方式
条件:urls.py文件中配置好url的访问路径.models.py文件中有Business表. 在views.py文件中实现的三种方式: from app01 improt models def b ...
多表连接的三种方式详解 HASH JOIN MERGE JOIN NESTED LOOP
在多表联合查询的时候,如果我们查看它的执行计划,就会发现里面有多表之间的连接方式. 之前打算在sqlplus中用执行计划的,但是格式看起来有点乱,就用Toad 做了3个截图. 从3张图里我们看到了几点 ...
form表单提交三种方式，demo实例详解
第一种:使用type=submit 可以直接提交 <html> <head> <title>submit直接提交</title> </head& ...
Django创建多对多表关系的三种方式
方式一:全自动(不推荐) 优点:django orm会自动创建第三张表缺点:只会创建两个表的关系字段,不会再额外添加字段,可扩展性差 class Book(models.Model): # ... ...
ORACLE 两表关联更新三种方式
不多说了,我们来做实验吧. 创建如下表数据 select * from t1 ; select * from t2; 现需求:参照T2表,修改T1表,修改条件为两表的fname列内容一致. 方式1,u ...
PHP连接数据库、创建数据库、创建表的三种方式
这篇博客主要介绍了三种方式来连接MySQL数据库以及创建数据库.创建表.(代码是我在原来的基础上改的) MySQLi - 面向对象 MySQLi - 面向过程 PDO MySQLi 面向对象 < ...

随机推荐

程序时间计算函数（被tle出阴影来了）
初次意识到程序的时间复杂度(tle多了 ) 第一次写博客(被大佬们的博客所折服orz) 拿打素数表的程序为例优化前代码: #include<iostream> #include<c ...
ZOHO的下一个25年：用心为企业服务
来源:中国软件网作者:海策在25周年会上,ZOHO大中华区总裁侯康宁先生豪情壮志,"25岁的ZOHO,已经成长为非典型一线大厂." 1996年,ZOHO成立.截止2021年,Z ...
CRM帮助初创企业降本增效的四个方法
对大部分初创公司来说,只有少数企业能够实现盈利,大部分只能维持盈亏平衡甚至是亏损.这是因为初创企业很难在短时间之内找到稳定的赢利点,而企业面临的风险和投入又是无法预知的.初创企业想要快速盈利,只能降低 ...
Java堆的理解
堆的核心概述所有的对象实例以及数组都应当在运行时分配在堆上从实际实用角度看 --"几乎所有的对象实例都在堆中分配内存" 数组和对象可能永远不会存储在栈上,因为栈帧中保存引用,这 ...
Java中Stream流相关介绍
什么是Stream? Stream是JDK8 API的新成员,它允许以声明性方式处理数据集合特点代码简洁: 函数式编程写出的代码简洁且意图明确,使用stream接口让你从此告别for循环多核友好 ...
Android面试必问！View 事件分发机制，看这一篇就够了！
在 Android 开发当中,View 的事件分发机制是一块很重要的知识.不仅在开发当中经常需要用到,面试的时候也经常被问到. 如果你在面试的时候,能把这块讲清楚,对于校招生或者实习生来说,算是一块不 ...
前端必读：Vue响应式系统大PK（下）
转载请注明出处:葡萄城官网,葡萄城为开发者提供专业的开发工具.解决方案和服务,赋能开发者. 原文参考:https://www.sitepoint.com/vue-3-reactivity-system ...
Shell $?获取函数返回值或者上一个命令的退出状态
Shell $?获取函数返回值或者上一个命令的退出状态来自:互联网时间:2021-01-12 阅读:2 $? 是一个特殊变量,用来获取上一个命令的退出状态,或者上一个函数的返回值. 所谓退出状态, ...
CentOS 7 设置时区、日期和时间
CentOS 7 设置时区.日期和时间 changhr2013关注 2019.04.19 01:33:09字数 307阅读 139 在 CentOS 7 中,引入了一个叫 timedatectl 的设 ...
要想在for语句中直接定义一个变量
要想在for语句中直接定义一个变量 (如下的代码) 1 for(uint16_t i=0;i<10;i++); 2 if( GPIO_ReadInputDataBit(GPIOA, GPI ...

示例讲解PostgreSQL表分区的三种方式