MySQL全面瓦解12:连接查询的原理和应用

概述

MySQL最强大的功能之一就是能在数据检索的执行中连接(join)表。大部分的单表数据查询并不能满足我们的需求,这时候我们就需要连接一个或者多个表,并通过一些条件过滤筛选出我们需要的数据。

了解MySQL连接查询之前我们先来理解下笛卡尔积的原理。

数据准备

依旧使用上节的表数据(包含classes 班级表和students 学生表):

 1 mysql> select * from classes;
 2 +---------+-----------+
 3 | classid | classname |
 4  5 |       1 | 初三一班   6 2 | 初三二班   7 3 | 初三三班   8 4 | 初三四班   9 10 4 rows in set
11 
12 mysql students;
13 ---------+-------------+-------+---------+
14 | studentid | studentname | score 15 16 |         | brand       | 97.5  17 | helen       96.5  18 | lyn         96    19 | sol         97    20 7 | b1          81    21 8 | b2          82    22 |        13 | c1          71    23 14 | c2          72.5  24 19 | lala        51    0 25 26 9 rows set 

笛卡尔积

笛卡尔积:也就是笛卡尔乘积,假设两个集合A和B,笛卡尔积表示A集合中的元素和B集合中的元素任意相互关联产生的所有可能的结果。

比如A中有m个元素,B中有n个元素,A、B笛卡尔积产生的结果有m*n个结果,相当于循环遍历两个集合中的元素,任意组合。

笛卡尔积在SQL中的实现方式既是交叉连接(Cross Join)。所有连接方式都会先生成临时笛卡尔积表,笛卡尔积是关系代数里的一个概念,表示两个表中的每一行数据任意组合。

所以上面的表就是 4(班级表)* 9(学生表) = 36条数据;

笛卡尔积语法格式:

1 select cname1,cname2,...  tname1,tname2,...;
2 or
3 select cname from tname1 join tname2 [join tname...];

图例表示:

 

上述两个表实际执行结果如下:

from classes a,students b order by a.classid,b.studentid;
-------+-----------+-----------+-------------+-------+---------+
-------+-----------+-----------+-------------+-------+---------+
 5 |       1 | 初三一班  |         1 | brand       | 97.5  |       1 |
 6 |       1 | 初三一班  |         2 | helen       | 96.5  |       1 |
 7 |       1 | 初三一班  |         3 | lyn         | 96    |       1 |
 8 |       1 | 初三一班  |         4 | sol         | 97    |       1 |
 9 |       1 | 初三一班  |         7 | b1          | 81    |       2 |
10 |       1 | 初三一班  |         8 | b2          | 82    |       2 |
11 |       1 | 初三一班  |        13 | c1          | 71    |       3 |
12 |       1 | 初三一班  |        14 | c2          | 72.5  |       3 |
13 |       1 | 初三一班  |        19 | lala        | 51    |       0 |
14 |       2 | 初三二班  |         1 | brand       | 97.5  |       1 |
15 |       2 | 初三二班  |         2 | helen       | 96.5  |       1 |
16 |       2 | 初三二班  |         3 | lyn         | 96    |       1 |
17 |       2 | 初三二班  |         4 | sol         | 97    |       1 |
18 |       2 | 初三二班  |         7 | b1          | 81    |       2 |
19 |       2 | 初三二班  |         8 | b2          | 82    |       2 |
20 |       2 | 初三二班  |        13 | c1          | 71    |       3 |
21 |       2 | 初三二班  |        14 | c2          | 72.5  |       3 |
22 |       2 | 初三二班  |        19 | lala        | 51    |       0 |
23 |       3 | 初三三班  |         1 | brand       | 97.5  |       1 |
24 |       3 | 初三三班  |         2 | helen       | 96.5  |       1 |
25 |       3 | 初三三班  |         3 | lyn         | 96    |       1 |
26 |       3 | 初三三班  |         4 | sol         | 97    |       1 |
27 |       3 | 初三三班  |         7 | b1          | 81    |       2 |
28 |       3 | 初三三班  |         8 | b2          | 82    |       2 |
29 |       3 | 初三三班  |        13 | c1          | 71    |       3 |
30 |       3 | 初三三班  |        14 | c2          | 72.5  |       3 |
31 |       3 | 初三三班  |        19 | lala        | 51    |       0 |
32 |       4 | 初三四班  |         1 | brand       | 97.5  |       1 |
33 |       4 | 初三四班  |         2 | helen       | 96.5  |       1 |
34 |       4 | 初三四班  |         3 | lyn         | 96    |       1 |
35 |       4 | 初三四班  |         4 | sol         | 97    |       1 |
36 |       4 | 初三四班  |         7 | b1          | 81    |       2 |
37 |       4 | 初三四班  |         8 | b2          | 82    |       2 |
38 |       4 | 初三四班  |        13 | c1          | 71    |       3 |
39 |       4 | 初三四班  |        14 | c2          | 72.5  |       3 |
40 |       4 | 初三四班  |        19 | lala        | 51    |       0 |
41 42 36 rows set 

这样的数据肯定不是我们想要的,在实际应用中,表连接时要加上限制条件,才能够筛选出我们真正需要的数据。

我们主要的连接查询有这几种:内连接、左(外)连接、右(外)连接,下面我们一 一来看。

内连接查询 inner join

语法格式:

from tname1 inner join tname2 on join condition;
或者
from tname1 join tname2 on join4 5 from tname1,tname2 [where join condition];

说明:在笛卡尔积的基础上加上了连接条件,组合两个表,返回符合连接条件的记录,也就是返回两个表的交集(阴影)部分。如果没有加上这个连接条件,就是上面笛卡尔积的结果。

select a.classname,b.studentname,b.score from classes a join students b on a.classid = b.classid;
---------+-------------+-------+
11 12 8 rows set

从上面的数据可以看出 ,初三四班 classid = 4,因为没有关联的学生,所以被过滤掉了;lala 同学的classid=0,没法关联到具体的班级,也被过滤掉了,只取两表都有的数据交集

where a.classid = b.classid and a.classid=1;
set 

查找1班同学的成绩信息,上面语法格式的第三种,这种方式简洁高效,直接在连接查询的结果后面进行Where条件筛选。 

左连接查询 left join

left join on / left outer join on,语法格式:

from tname1 left join tname2 on join condition;

说明: left join 是left outer join的简写,全称是左外连接,外连接中的一种。 左(外)连接,左表(classes)的记录将会全部出来,而右表(students)只会显示符合搜索条件的记录。右表无法关联的内容均为null。

 

from classes a left | NULL        NULL  set

 从上面结果中可以看出,初三四班无法找到对应的学生,所以后面两个字段使用null标识。 

右连接查询 right join

right join on / right outer join on,语法格式:

right on join condition;

说明:right join是right outer join的简写,全称是右外连接,外连接中的一种。与左(外)连接相反,右(外)连接,左表(classes)只会显示符合搜索条件的记录,而右表(students)的记录将会全部表示出来。左表记录不足的地方均为NULL。 

 

 

NULL      set

  从上面结果中可以看出,lala同学无法找到班级,所以班级名称字段为null。  

 

连接查询+聚合函数

使用连接查询的时候,经常会配合使用聚集函数来进行数据汇总。比如在上面的数据基础上查询出每个班级的人数和平均分数、班级总分数。

select a.classname as '班级名称',count(b.studentid) 总人数sum(b.score) 总分avg(b.score) 平均分' 
 2  b.classid 
 3 group by a.classid,a.classname;
--------+--------+--------+-----------+
| 班级名称 | 总人数 | 总分   | 平均分    | 初三一班 |      387.00 96.750000 | 初三二班 163.00 81.500000 | 初三三班 143.50 71.750000 3 rows set 

这边连表查询的同时对班级(classid,classname)做了分组,并输出每个班级的人数、平均分、班级总分。

连接查询附加过滤条件

使用连接查询之后,大概率会对数据进行在过滤筛选,所以我们可以在连接查询之后再加上where条件,比如我们根据上述的结果只取出一班的同学信息。

= b.classid where a.classid=1set 

如上,只输出一班的同学,同理,可以附件 limit 限制,order by排序等操作。

总结

1、连接查询必然要带上连接条件,否则会变成笛卡尔乘积数据,使用不正确的联结条件,也将返回不正确的数据。

2、SQL规范推荐首选INNER JOIN语法。但是连接的几种方式本身并没有明显的性能差距,性能的差距主要是由数据的结构、连接的条件,索引的使用等多种条件综合决定的。

我们应该根据实际的业务场景来决定,比如上述数据场景:如果要求返回返回有学生的班级就使用 inner join;如果必须输出所有班级则使用left join;如果必须输出所有学生,则使用right join。

3、性能上的考虑,MySQL在运行时会根据关联条件处理连接的表,这种处理可能是非常耗费资源的,连接的表越多,性能下降越厉害。所以要分析去除那些不必要的连接和不需要显示的字段。

之前我的项目团队在优化旧的业务代码时,发现随着业务的变更,某些数据不需要显示,对应的某个连接也不需要了,去掉之后,性能较大提升。

版权声明:本文内容由互联网用户自发贡献,该文观点与技术仅代表作者本人。本站仅提供信息存储空间服务,不拥有所有权,不承担相关法律责任。如发现本站有涉嫌侵权/违法违规的内容, 请发送邮件至 dio@foxmail.com 举报,一经查实,本站将立刻删除。

相关推荐


在正式开始之前,我们先来看下 MySQL 服务器的配置和版本号信息,如下图所示: “兵马未动粮草先行”,看完了相关的配置之后,我们先来创建一张测试表和一些测试数据。 -- 如果存在 person 表先删除 DROP TABLE IF EXISTS person; -- 创建 person 表,其中
> [合辑地址:MySQL全面瓦解](https://www.cnblogs.com/wzh2010/category/1859594.html "合辑地址:MySQL全面瓦解") # 1 为什么需要数据库备份 - 灾难恢复:当发生数据灾难的时候,需要对损坏的数据进行恢复和
物理服务机的CPU、内存、存储设备、连接数等资源有限,某个时段大量连接同时执行操作,会导致数据库在处理上遇到性能瓶颈。为了解决这个问题,行业先驱门充分发扬了分而治之的思想,对大库表进行分割,
然后实施更好的控制和管理,同时使用多台机器的CPU、内存、存储,提供更好的性能。而分治有两种实现方式:垂直拆
1 回顾 上一节我们详细讲解了如何对数据库进行分区操作,包括了 垂直拆分(Scale Up 纵向扩展)和 水平拆分(Scale Out 横向扩展) ,同时简要整理了水平分区的几种策略,现在来回顾一下。 2 水平分区的5种策略 2.1 Hash(哈希) 这种策略是通过对表的一个或多个列的Ha
navicat查看某个表的所有字段的详细信息 navicat设计表只能一次查看一个字段的备注信息,那怎么才能做到一次性查询表的信息呢?SELECT COLUMN_NAME,COLUMN_COMMENT,COLUMN_TYPE,COLUMN_KEY FROM information_schema.CO
文章浏览阅读4.3k次。转载请把头部出处链接和尾部二维码一起转载,本文出自逆流的鱼yuiop:http://blog.csdn.net/hejjunlin/article/details/52768613前言:数据库每天的数据不断增多,自动删除机制总体风险太大,想保留更多历史性的数据供查询,于是从小的hbase换到大的hbase上,势在必行。今天记录下这次数据仓库迁移。看下Agenda:彻底卸载MySQL安装MySQL_linux服务器进行数据迁移
文章浏览阅读488次。恢复步骤概要备份frm、ibd文件如果mysql版本发生变化,安装回原本的mysql版本创建和原本库名一致新库,字符集都要保持一样通过frm获取到原先的表结构,通过的得到的表结构创建一个和原先结构一样的空表。使用“ALTER TABLE DISCARD TABLESPACE;”命令卸载掉表空间将原先的ibd拷贝到mysql的仓库下添加用户权限 “chown . .ibd”,如果是操作和mysql的使用权限一致可以跳过通过“ALTER TABLE IMPORT TABLESPACE;”命令恢_alter table discard tablespace
文章浏览阅读225次。当MySQL单表记录数过大时,增删改查性能都会急剧下降,可以参考以下步骤来优化:单表优化除非单表数据未来会一直不断上涨,否则不要一开始就考虑拆分,拆分会带来逻辑、部署、运维的各种复杂度,一般以整型值为主的表在千万级以下,字符串为主的表在五百万以下是没有太大问题的。而事实上很多时候MySQL单表的性能依然有不少优化空间,甚至能正常支撑千万级以上的数据量:字段尽量使用TINYINT、SMALLINT、MEDIUM_INT作为整数类型而非INT,如果非负则加上UNSIGNEDVARCHAR的长度只分配_开发项目 浏览记录表 过大怎么办
文章浏览阅读1.5k次。Mysql创建、删除用户MySql中添加用户,新建数据库,用户授权,删除用户,修改密码(注意每行后边都跟个;表示一个命令语句结束):1.新建用户登录MYSQL:@>mysql -u root -p@>密码创建用户:mysql> insert into mysql.user(Host,User,Password) values("localhost_删除mysql用户组
MySQL是一种开源的关系型数据库管理系统,被广泛应用于各类应用程序的开发中。对于MySQL中的字段,我们需要进行数据类型以及默认值的设置,这对于数据的存储和使用至关重要。其中,有一个非常重要的概念就是MySQL字段默认字符串。 CREATE TABLE `my_...
MySQL是一个流行的开源关系型数据库管理系统,广泛应用于Web应用程序开发、数据存储和管理。在使用MySQL时,正确设置字符集非常重要,以确保数据的正确性和可靠性。 在MySQL中,字符集表示为一系列字符和字母的集合。MySQL支持多种字符集,包括ASCII、UTF...
MySQL存储函数 n以内偶数 MySQL存储函数能够帮助用户简化操作,提高效率,常常被用于计算和处理数据。下面我们就来了解一下如何使用MySQL存储函数计算n以内的偶数。 定义存储函数 首先,我们需要定义一个MySQL存储函数,以计算n以内的偶数。下...
MySQL是一个流行的关系型数据库管理系统,基于客户机-服务器模式,可在各种操作系统上运行。 MySQL支持多种字符集,不同的字符集包括不同的字符,如字母、数字、符号等,并提供不同的排序规则,以满足不同语言环境的需求。 //查看MySQL支持的字符集与校对规...
在MySQL数据库中,我们有时需要对特定的字符串进行截取并进行分组统计。这种操作对于数据分析和报表制作有着重要的应用。下面我们将讲解一些基本的字符串截取和分组统计的方法。 首先,我们可以使用substring函数对字段中的字符串进行截取。假设我们有一张表stude...
MySQL提供了多种字符串的查找函数。下面我们就一一介绍。 1. LIKE函数 SELECT * FROM mytable WHERE mycolumn LIKE 'apple%'; 其中"apple%"表示以apple开头的字符串,%表示任意多个字符...
MySQL 是一种关系型数据库管理系统,广泛应用于各种不同规模和类型的应用程序中。在 MySQL 中,处理字符串数据是很常见的任务。有时候,我们需要在字符串的开头添加一定数量的 0 ,以达到一定的位数。比如,我们可能需要将一个数字转换为 4 位或 5 位的字符串,不足的...
MySQL是一种流行的关系型数据库管理系统,支持多种数据类型。以下是MySQL所支持的数据类型: 1. 数值型数据类型: - TINYINT 保存-128到127范围内的整数 - SMALLINT 保存-32768到32767范围内的整数 - MEDIU...
MySQL中存储Emoji表情字段类型 在现代互联网生态中,表情符号已经成为人们展示情感和思想的重要方式之一,因此将表情符号存储到数据库中是一个经常出现的问题。MySQL作为最流行的开源关系型数据库管理系统之一,也需要能够存储和管理这些表情符号的字段类型。 UT...
MySQL是一种关系型数据库管理系统。在MySQL数据库中,有多种不同的数据类型。而其中,最常见的数据类型之一就是字符串类型。在MySQL中,字符串类型的数据通常会被存储为TEXT或VARCHAR类型。 首先,让我们来看一下VARCHAR类型。VARCHAR是My...
MySQL字符串取整知识详解 MySQL是一种开源的关系型数据库管理系统,广泛应用于各个领域。在使用MySQL过程当中,我们经常需要对数据进行取整操作。本文将介绍如何使用MySQL字符串取整来处理数据取整问题。 什么是MySQL字符串取整? MySQL...