Mysql Join语法解析与性能分析

一.Join语法概述

join 用于多表中字段之间的联系,语法如下:

... FROM table1 INNER|LEFT|RIGHT JOIN table2 ON conditiona

table1:左表;table2:右表。

JOIN 按照功能大致分为如下三类:

INNER JOIN(内连接,或等值连接):取得两个表中存在连接匹配关系的记录。

LEFT JOIN(左连接):取得左表(table1)完全记录,即是右表(table2)并无对应匹配记录。

RIGHT JOIN(右连接):与 LEFT JOIN 相反,取得右表(table2)完全记录,即是左表(table1)并无匹配对应记录。

注意:mysql不支持Full join,不过可以通过UNION 关键字来合并 LEFT JOIN 与 RIGHT JOIN来模拟FULL join.

接下来给出一个列子用于解释下面几种分类。如下两个表(A,B)

mysql> select A.id,A.name,B.name from A,B where A.id=B.id;

+----+-----------+-------------+

| id | name       | name             |

+----+-----------+-------------+

|  1 | Pirate       | Rutabaga      |

|  2 | Monkey    | Pirate            |

|  3 | Ninja         | Darth Vader |

|  4 | Spaghetti  | Ninja             |

+----+-----------+-------------+

4 rows in set (0.00 sec)

.Inner join

内连接,也叫等值连接,inner join产生同时符合A和B的一组数据。

mysql> select * from A inner join B on A.name = B.name;

+----+--------+----+--------+

| id | name   | id | name   |

+----+--------+----+--------+

|  1 | Pirate |  2 | Pirate |

|  3 | Ninja  |  4 | Ninja  |

+----+--------+----+--------+

.Left join

mysql> select * from A left join B on A.name = B.name;

#或者:select * from A left outer join B on A.name = B.name;

+----+-----------+------+--------+

| id | name      | id   | name   |

+----+-----------+------+--------+

|  1 | Pirate    |    2 | Pirate |

|  2 | Monkey    | NULL | NULL   |

|  3 | Ninja     |    4 | Ninja  |

|  4 | Spaghetti | NULL | NULL   |

+----+-----------+------+--------+

4 rows in set (0.00 sec)

left join,(或left outer join:Mysql中两者等价,推荐使用left join.)左连接从左表(A)产生一套完整的记录,与匹配的记录(右表(B)) .如果没有匹配,右侧将包含null。

如果想只从左表(A)中产生一套记录,但不包含右表(B)的记录,可以通过设置where语句来执行,如下:

mysql> select * from A left join B on A.name=B.name where A.id is null or B.id is null;

+----+-----------+------+------+

| id | name      | id   | name |

+----+-----------+------+------+

|  2 | Monkey    | NULL | NULL |

|  4 | Spaghetti | NULL | NULL |

+----+-----------+------+------+

2 rows in set (0.00 sec)

同理,还可以模拟inner join. 如下:

mysql> select * from A left join B on A.name=B.name where A.id is not null and B.id is not null;

+----+--------+------+--------+

| id | name   | id   | name   |

+----+--------+------+--------+

|  1 | Pirate |    2 | Pirate |

|  3 | Ninja  |    4 | Ninja  |

+----+--------+------+--------+

2 rows in set (0.00 sec)

求差集:

根据上面的例子可以求差集,如下:

SELECT * FROM A LEFT JOIN B ON A.name = B.name

WHERE B.id IS NULL

union

SELECT * FROM A right JOIN B ON A.name = B.name

WHERE A.id IS NULL;

# 结果

+------+-----------+------+-------------+

| id   | name      | id   | name        |

+------+-----------+------+-------------+

|    2 | Monkey    | NULL | NULL        |

|    4 | Spaghetti | NULL | NULL        |

| NULL | NULL      |    1 | Rutabaga    |

| NULL | NULL      |    3 | Darth Vader |

+------+-----------+------+-------------+

.Right join

mysql> select * from A right join B on A.name = B.name;

+------+--------+----+-------------+

| id   | name   | id | name        |

+------+--------+----+-------------+

| NULL | NULL   |  1 | Rutabaga    |

|    1 | Pirate |  2 | Pirate      |

| NULL | NULL   |  3 | Darth Vader |

|    3 | Ninja  |  4 | Ninja       |

+------+--------+----+-------------+

4 rows in set (0.00 sec)

同left join。

.Cross join

cross join:交叉连接,得到的结果是两个表的乘积,即笛卡尔积

笛卡尔(Descartes)乘积又叫直积。假设集合A={a,b},集合B={0,1,2},则两个集合的笛卡尔积为{(a,0),(a,1),(a,2),(b,0),(b,1), (b,2)}。可以扩展到多个集合的情况。类似的例子有,如果A表示某学校学生的集合,B表示该学校所有课程的集合,则A与B的笛卡尔积表示所有可能的选课情况。

mysql> select * from A cross join B;

+----+-----------+----+-------------+

| id | name      | id | name        |

+----+-----------+----+-------------+

|  1 | Pirate    |  1 | Rutabaga    |

|  2 | Monkey    |  1 | Rutabaga    |

|  3 | Ninja     |  1 | Rutabaga    |

|  4 | Spaghetti |  1 | Rutabaga    |

|  1 | Pirate    |  2 | Pirate      |

|  2 | Monkey    |  2 | Pirate      |

|  3 | Ninja     |  2 | Pirate      |

|  4 | Spaghetti |  2 | Pirate      |

|  1 | Pirate    |  3 | Darth Vader |

|  2 | Monkey    |  3 | Darth Vader |

|  3 | Ninja     |  3 | Darth Vader |

|  4 | Spaghetti |  3 | Darth Vader |

|  1 | Pirate    |  4 | Ninja       |

|  2 | Monkey    |  4 | Ninja       |

|  3 | Ninja     |  4 | Ninja       |

|  4 | Spaghetti |  4 | Ninja       |

+----+-----------+----+-------------+

16 rows in set (0.00 sec)

#再执行:mysql> select * from A inner join B; 试一试

#在执行mysql> select * from A cross join B on A.name = B.name; 试一试

实际上, MySQL 中(仅限于 MySQL CROSS JOIN INNER JOIN 的表现是一样的,在不指定 ON 条件得到的结果都是笛卡尔积,反之取得两个表完全匹配的结果。
INNER JOIN 与 CROSS
JOIN 可以省略 INNER
或 CROSS
关键字,因此下面的 SQL 效果是一样的:

... FROM table1 INNER JOIN table2

... FROM table1 CROSS JOIN table2

... FROM table1 JOIN table2

.Full join

mysql> select * from A left join B on B.name = A.name

-> union

-> select * from A right join
B on B.name = A.name;

+------+-----------+------+-------------+

| id   | name      | id  
| name        |

+------+-----------+------+-------------+

|    1 | Pirate    |   
2 | Pirate      |

|    2 | Monkey    | NULL | NULL        |

|    3 | Ninja     |   
4 | Ninja       |

|    4 | Spaghetti | NULL | NULL        |

| NULL | NULL      |    1 | Rutabaga    |

| NULL | NULL      |    3 | Darth Vader |

+------+-----------+------+-------------+

6 rows in set (0.00 sec)

全连接产生的所有记录(双方匹配记录)在表A和表B。如果没有匹配,则对面将包含null。

.性能优化

1.显示(explicit)
inner join VS
隐式(implicit) inner join

如:

select * from

table a inner join table b

on a.id = b.id;

VS

select a.*, b.*

from table a, table b

where a.id = b.id;

我在数据库中比较(10w数据)得之,它们用时几乎相同,第一个是显示的inner
join,后一个是隐式的inner
join。

参照:Explicit
vs implicit SQL joins

2.left join/right join VS inner
join

尽量用inner
join.避免 LEFT
JOIN 和 NULL.

在使用left
join(或right
join)时,应该清楚的知道以下几点:

(1). on where的执行顺序

ON 条件(“A
LEFT JOIN B ON 条件表达式”中的ON)用来决定如何从 B 表中检索数据行。如果 B 表中没有任何一行数据匹配 ON 的条件,将会额外生成一行所有列为 NULL 的数据,在匹配阶段 WHERE
子句的条件都不会被使用。仅在匹配阶段完成以后,WHERE 子句条件才会被使用。它将从匹配阶段产生的数据中检索过滤。

所以我们要注意:在使用Left (right) join的时候,一定要在先给出尽可能多的匹配满足条件,减少Where的执行。如:

PASS

select * from A

inner join B on B.name = A.name

left join C on C.name = B.name

left join D on D.id = C.id

where C.status>1 and D.status=1;

Great

select * from A

inner join B on B.name = A.name

left join C on C.name = B.name and C.status>1

left join D on D.id = C.id and D.status=1

从上面例子可以看出,尽可能满足ON的条件,而少用Where的条件。从执行性能来看第二个显然更加省时。

(2).注意ON 子句和 WHERE
子句的不同

如作者举了一个列子:

mysql> SELECT * FROM product LEFT JOIN product_details

ON (product.id =
product_details.id)

AND product_details.id=2;

+----+--------+------+--------+-------+

| id | amount | id   | weight |
exist |

+----+--------+------+--------+-------+

|  1 |    100 | NULL |   NULL | 
NULL |

|  2 |    200 |   
2 |     22 |     0 |

|  3 |    300 | NULL |   NULL | 
NULL |

|  4 |    400 | NULL |   NULL | 
NULL |

+----+--------+------+--------+-------+

4 rows in set (0.00 sec)

mysql> SELECT * FROM product LEFT JOIN product_details

ON (product.id =
product_details.id)

WHERE product_details.id=2;

+----+--------+----+--------+-------+

| id | amount | id | weight | exist |

+----+--------+----+--------+-------+

|  2 |    200 | 
2 |     22 |     0 |

+----+--------+----+--------+-------+

1 row in set (0.01 sec)

从上可知,第一条查询使用 ON 条件决定了从 LEFT JOIN的 product_details表中检索符合的所有数据行。第二条查询做了简单的LEFT
JOIN,然后使用 WHERE
子句从 LEFT
JOIN的数据中过滤掉不符合条件的数据行。

(3).尽量避免子查询,而用join

往往性能这玩意儿,更多时候体现在数据量比较大的时候,此时,我们应该避免复杂的子查询。如下:

PASS

insert into t1(a1) select b1 from t2 where not exists(select 1 from t1
where t1.id = t2.r_id);

Great

insert into t1(a1)

select b1 from t2

left join (select distinct t1.id from t1 ) t1 on t1.id = t2.r_id

where t1.id is null;

补充:MySQL
STRAIGHT_JOIN
NATURAL JOIN的使用

straight_join实现强制多表的载入顺序,从左到右,如:

...A straight_join B on A.name = B.name

straight_join完全等同于inner
join 只不过,join语法是根据“哪个表的结果集小,就以哪个表为驱动表”来决定谁先载入的,而straight_join
会强制选择其左边的表先载入。

往往我们在分析mysql处理性能时,如(Explain),如果发现mysql在载入顺序不合理的情况下,可以使用这个语句,但往往mysql能够自动的分析并处理好。

 

MySQL- -Join语法解析与性能分析的更多相关文章

  1. (转)MySQL join语法解析与性能分析

    文章转载的:http://www.cnblogs.com/BeginMan/p/3754322.html 一.join语法概述 join用于多表中字段之间的联系,语法如下: ... FROM tabl ...

  2. [转]Mysql Join语法解析与性能分析

    转自:http://www.cnblogs.com/BeginMan/p/3754322.html 一.Join语法概述 join 用于多表中字段之间的联系,语法如下: ... FROM table1 ...

  3. Mysql Join语法解析与性能分析详解

    一.Join语法概述 join 用于多表中字段之间的联系,语法如下: ... FROM table1 INNER|LEFT|RIGHT JOIN table2 ON conditiona table1 ...

  4. MYSQL索引结构原理、性能分析与优化

    [转]MYSQL索引结构原理.性能分析与优化 第一部分:基础知识 索引 官方介绍索引是帮助MySQL高效获取数据的数据结构.笔者理解索引相当于一本书的目录,通过目录就知道要的资料在哪里, 不用一页一页 ...

  5. 【转】由浅入深探究mysql索引结构原理、性能分析与优化

    摘要: 第一部分:基础知识 第二部分:MYISAM和INNODB索引结构 1.简单介绍B-tree B+ tree树 2.MyisAM索引结构 3.Annode索引结构 4.MyisAM索引与Inno ...

  6. Mysql视图的作用及其性能分析

    定义:视图是从一个或几个基本表导出的表,它与基本表不同,是一个虚表. 作用: 1.简化操作,不用进行多表查询. 2.当不同种类的用用户共享同一个数据库时,非常灵活,(用户以不同的 方式看待同一数据. ...

  7. Mysql Join语法以及性能优化

    引言 内外联结的区别是内联结将去除所有不符合条件的记录,而外联结则保留其中部分.外左联结与外右联结的区别在于如果用A左联结B则A中所有记录都会保留在结果中,此时B中只有符合联结条件的记录,而右联结相反 ...

  8. 由浅入深探究mysql索引结构原理、性能分析与优化 转

    第一部分:基础知识 第二部分:MYISAM和INNODB索引结构 1. 简单介绍B-tree B+ tree树 2. MyisAM索引结构 3. Annode索引结构 4. MyisAM索引与Inno ...

  9. 由浅入深探究mysql索引结构原理、性能分析与优化

    摘要: 第一部分:基础知识 第二部分:MYISAM和INNODB索引结构 1.简单介绍B-tree B+ tree树 2.MyisAM索引结构 3.Annode索引结构 4.MyisAM索引与Inno ...

随机推荐

  1. JavaScript无缝滚动

    <!DOCTYPE html> <html> <head lang="en"> <meta charset="UTF-8&quo ...

  2. apache activemq的重连

    1.activemq的重连机制 maxReconnectAttempts -1 | 0 From version 5.6 onwards: -1 is default and means retry ...

  3. Kalman滤波器原理和实现

    Kalman滤波器原理和实现 kalman filter Kalman滤波器的直观理解[1] 假设我们要测量一个房间下一刻钟的温度.据经验判断,房间内的温度不可能短时大幅度变化,也就是说可以依经验认为 ...

  4. H

    很爽的一局,打了70分钟,还刷新了我的最高击杀记录.打完出来一看居然是H局,第一次在H局里打出不错的表现诶.好像找人说一说,可惜并没有谁听,以前的朋友也不在了,还是算了,自己心里慢慢发霉去吧. 这局末 ...

  5. spring框架设计理念(上)

    一.前言    spring的应用非常的广泛,在开发过程中我们经常接触,可能会有一种感觉:对spring即熟悉又陌生,熟悉体现在我们几乎每天都在使用,对spring的IOC.AOP功能都有了基本的了解 ...

  6. NOIP 2005 等价表达式 (TYVJ P1060)

    做题记录: 2016-08-10 23:35:09 背景 NOIP2005 提高组 第四道 描述 明明进了中学之后,学到了代数表达式.有一天,他碰到一个很麻烦的选择题.这个题目的题干中首先给出了一个代 ...

  7. 关于scrollbar-face-color只支持ie的解决办法!

    关于scrollbar-face-color只支持ie的解决方法!!今天突然有人问我滚动条css自定义的方法,我发现用scrollbar-base-color这种方法只有ie支持,查了半天资料总结如下 ...

  8. 【BZOJ2438】 [中山市选2011]杀人游戏 tarjan强连通分量+缩点

    Description 一位冷血的杀手潜入 Na-wiat,并假装成平民.警察希望能在 N 个人里面,查出谁是杀手. 警察能够对每一个人进行查证,假如查证的对象是平民,他会告诉警察,他认识的人, 谁是 ...

  9. Oracle 游标使用全解(转)

    -- 声明游标:CURSOR cursor_name IS select_statement --For 循环游标 --(1)定义游标 --(2)定义游标变量 --(3)使用for循环来使用这个游标 ...

  10. Oracle临时表GLOBAL TEMPORARY TABLE

    临时表:像普通表一样,有结构,但是对数据的管理上不一样,临时表存储事务或会话的中间结果集,临时表中保存的数据只对当前 会话可见,所有会话都看不到其他会话的数据,即使其他会话提交了,也看不到.临时表不存 ...