详解SQL的四种连接-左外连接、右外连接、内连接、全连接
1、内联接(典型的联接运算,使⽤像 = 或 <> 之类的⽐较运算符)。包括相等联接和⾃然联接。
内联接使⽤⽐较运算符根据每个表共有的列的值匹配两个表中的⾏。例如,检索 students和courses表中学⽣标识号相同的所有⾏。
2、外联接。外联接可以是左向外联接、右向外联接或完整外部联接。
在 FROM⼦句中指定外联接时,可以由下列⼏组关键字中的⼀组指定:
1)LEFT JOIN或LEFT OUTER JOIN
左向外联接的结果集包括 LEFT OUTER⼦句中指定的左表的所有⾏,⽽不仅仅是联接列所匹配的⾏。如果左表的某⾏在右表中没有匹配⾏,则在相关联的结果集⾏中右表的所有选择列表列均为空值。
2)RIGHT JOIN 或 RIGHT OUTER JOIN
右向外联接是左向外联接的反向联接。将返回右表的所有⾏。如果右表的某⾏在左表中没有匹配⾏,则将为左表返回空值。
3)FULL JOIN 或 FULL OUTER JOIN
完整外部联接返回左表和右表中的所有⾏。当某⾏在另⼀个表中没有匹配⾏时,则另⼀个表的选择列表列包含空值。如果表之间有匹配⾏,则整个结果集⾏包含基表的数据值。
3、交叉联接
交叉联接返回左表中的所有⾏,左表中的每⼀⾏与右表中的所有⾏组合。交叉联接也称作笛卡尔积。
FROM ⼦句中的表或视图可通过内联接或完整外部联接按任意顺序指定;但是,⽤左或右向外联接指定表或视图时,表或视图的顺序很重要。有关使⽤左或右向外联接排列表的更多信息,请参见使⽤外联接。
例⼦:
-------------------------------------------------
a表 id name b表 id job parent_id
1 张3 1 23 1
2 李四 2 34 2
3 王武 3 3
4 4
a.id同parent_id 存在关系
--------------------------------------------------
1)内连接
select a.*,b.* from a inner join b on a.id=b.parent_id
结果是
1 张3 1 23 1
2 李四 2 34 2
2)左连接
select a.*,b.* from a left join b on a.id=b.parent_id <=> select a.*,b.* from a , b where a.id=b.parent_id(+)
结果是
1 张3 1 23 1
2 李四 2 34 2
3 王武 null
3)右连接
select a.*,b.* from a right join b on a.id=b.parent_id <=> select a.*,b.* from a , b where a.id(+)=b.parent_id
结果是
1 张3 1 23 1
2 李四 2 34 2
null 3 34 4
4)完全连接
select a.*,b.* from a full join b on a.id=b.parent_id
结果是
1 张3 1 23 1
2 李四 2 34 2
null 3 34 4
null 3 34 4
3 王武 null
--------------------------------------------------------------------------------------------⼀、交叉连接(CROSS JOIN)
交叉连接(CROSS JOIN):有两种,显式的和隐式的,不带ON⼦句,返回的是两表的乘积,也叫笛卡尔积。
例如:下⾯的语句1和语句2的结果是相同的。
语句1:隐式的交叉连接,没有CROSS JOIN。
SELECT O.ID, O.ORDER_NUMBER, C.ID, C.NAME
FROM ORDERS O , CUSTOMERS C
WHERE O.ID=1;
语句2:显式的交叉连接,使⽤CROSS JOIN。
SELECT O.ID,O.ORDER_NUMBER,C.ID,
C.NAME
FROM ORDERS O CROSS JOIN CUSTOMERS C
WHERE O.ID=1;
语句1和语句2的结果是相同的,查询结果如下:
⼆、内连接(INNER JOIN)
内连接(INNER JOIN):有两种,显式的和隐式的,返回连接表中符合连接条件和查询条件的数据⾏。(所谓的链接表就是数据库在做查询形成的中间表)。
例如:下⾯的语句3和语句4的结果是相同的。
语句3:隐式的内连接,没有INNER JOIN,形成的中间表为两个表的笛卡尔积。
SELECT O.ID,O.ORDER_NUMBER,C.ID,C.NAME
FROM CUSTOMERS C,ORDERS O
WHERE C.ID=O.CUSTOMER_ID;
语句4:显⽰的内连接,⼀般称为内连接,有INNER JOIN,形成的中间表为两个表经过ON条件过滤后的笛卡尔积。
SELECT O.ID,O.ORDER_NUMBER,C.ID,C.NAME
FROM CUSTOMERS C INNER JOIN ORDERS O ON C.ID=O.CUSTOMER_ID;
语句3和语句4的查询结果:
三、外连接(OUTER JOIN):外连不但返回符合连接和查询条件的数据⾏,还返回不符合条件的⼀些⾏。外连接分三类:左外连接(LEFT OUTER JOIN)、右外连接(RIGHT OUTER JOIN)和全外连接(FULL OUTER JOIN)。
三者的共同点是都返回符合连接条件和查询条件(即:内连接)的数据⾏。不同点如下:
左外连接还返回左表中不符合连接条件单符合查询条件的数据⾏。
右外连接还返回右表中不符合连接条件单符合查询条件的数据⾏。
全外连接还返回左表中不符合连接条件单符合查询条件的数据⾏,并且还返回右表中不符合连接条件单符合查询条件的数据⾏。全外连接实际是上左外连接和右外连接的数学合集(去掉重复),即“全外=左外 UNION 右外”。
说明:左表就是在“(LEFT OUTER JOIN)”关键字左边的表。右表当然就是右边的了。在三种类型的外连接中,OUTER 关键字是可省略的。
下⾯举例说明:
语句5:左外连接(LEFT OUTER JOIN)
SELECT O.ID,O.ORDER_NUMBER,O.CUSTOMER_ID,C.ID,C.NAME
FROM ORDERS O LEFT OUTER JOIN CUSTOMERS C ON C.ID=O.CUSTOMER_ID;
语句6:右外连接(RIGHT OUTER JOIN)
SELECT O.ID,O.ORDER_NUMBER,O.CUSTOMER_ID,C.ID,C.NAME
FROM ORDERS O RIGHT OUTER JOIN CUSTOMERS C ON C.ID=O.CUSTOMER_ID;
注意:WHERE条件放在ON后⾯查询的结果是不⼀样的。例如:
语句7:WHERE条件独⽴。
SELECT O.ID,O.ORDER_NUMBER,O.CUSTOMER_ID,C.ID,C.NAME
FROM ORDERS O LEFT OUTER JOIN CUSTOMERS C ON C.ID=O.CUSTOMER_ID
WHERE O.ORDER_NUMBER<>'MIKE_ORDER001';
语句8:将语句7中的WHERE条件放到ON后⾯。
SELECT O.ID,O.ORDER_NUMBER,O.CUSTOMER_ID,C.ID,C.NAME
FROM ORDERS O LEFT OUTER JOIN CUSTOMERS C ON C.ID=O.CUSTOMER_ID AND O.ORDER_NUMBER<>'MIKE_ORDER001';
从语句7和语句8查询的结果来看,显然是不相同的,语句8显⽰的结果是难以理解的。因此,推荐在写连接查询的时候,ON后⾯只跟连接条件,⽽对中间表限制的条件都写到WHERE⼦句中。
语句9:全外连接(FULL OUTER JOIN)。
SELECT O.ID,O.ORDER_NUMBER,O.CUSTOMER_ID,C.ID,C.NAME
FROM ORDERS O FULL OUTER JOIN CUSTOMERS C ON C.ID=O.CUSTOMER_ID;
注意:MySQL是不⽀持全外的连接的,这⾥给出的写法适合Oracle和DB2。但是可以通过左外和右外求合集来获取全外连接的查询结果。下图是上⾯SQL在Oracle下执⾏的结果:
语句10:左外和右外的合集,实际上查询结果和语句9是相同的。
SELECT O.ID,O.ORDER_NUMBER,O.CUSTOMER_ID,C.ID,C.NAME
FROM ORDERS O LEFT OUTER JOIN CUSTOMERS C ON C.ID=O.CUSTOMER_ID
UNION
SELECT O.ID,O.ORDER_NUMBER,O.CUSTOMER_ID,C.ID,C.NAME
FROM ORDERS O RIGHT OUTER JOIN CUSTOMERS C ON C.ID=O.CUSTOMER_ID;
语句9和语句10的查询结果是相同的,如下:
四、联合连接(UNION JOIN):这是⼀种很少见的连接⽅式。Oracle、MySQL均不⽀持,其作⽤是:出全外连接和内连接之间差异的所有⾏。这在数据分析中排错中⽐较常⽤。也可以利⽤数据库的集合操作来实现此功能。
语句11:联合查询(UNION JOIN)例句,还没有到能执⾏的SQL环境。
SELECT O.ID,O.ORDER_NUMBER,O.CUSTOMER_ID,C.ID,C.NAME
FROM ORDERS O UNION JOIN CUSTOMERS C ON C.ID=O.CUSTOMER_ID
语句12:语句11在DB2下的等价实现。还不知道DB2是否⽀持语句11呢!
SELECT O.ID,O.ORDER_NUMBER,O.CUSTOMER_ID,C.ID,C.NAME
FROM ORDERS O FULL OUTER JOIN CUSTOMERS C ON C.ID=O.CUSTOMER_ID
EXCEPT
SELECT O.ID,O.ORDER_NUMBER,O.CUSTOMER_ID,C.ID,C.NAME
FROM ORDERS O INNER JOIN CUSTOMERS C ON C.ID=O.CUSTOMER_ID;
语句13:语句11在Oracle下的等价实现。
SELECT O.ID,O.ORDER_NUMBER,O.CUSTOMER_ID,C.ID,C.NAME
FROM ORDERS O FULL OUTER JOIN CUSTOMERS C ON C.ID=O.CUSTOMER_ID
MINUS
SELECT O.ID,O.ORDER_NUMBER,O.CUSTOMER_ID,C.ID,C.NAME
FROM ORDERS O INNER JOIN CUSTOMERS C ON C.ID=O.CUSTOMER_ID;
查询结果如下:
五、⾃然连接(NATURAL INNER JOIN):说真的,这种连接查询没有存在的价值,既然是SQL2标准中定义的,就给出个例⼦看看吧。⾃然连接⽆需指定连接列,SQL会检查两个表中是否相同名称的列,且假设他们在连接条件中使⽤,并且在连接条件中仅包含⼀个连接列。不允许使⽤ON语句,不允许指定显⽰列,显⽰列只能⽤*表⽰(ORACLE环境下测试的)。对于每种连接类型(除了交叉连接外),均可指定NATURAL。下⾯给出⼏个例⼦。
语句14:
SELECT *
FROM ORDERS O NATURAL INNER JOIN CUSTOMERS C;
语句15:
SELECT *
FROM ORDERS O NATURAL LEFT OUTER JOIN CUSTOMERS C;
语句16:
SELECT *
FROM ORDERS O NATURAL RIGHT OUTER JOIN CUSTOMERS C;
语句17:
SELECT *
FROM ORDERS O NATURAL FULL OUTER JOIN CUSTOMERS C;
六、SQL查询的基本原理:两种情况介绍。
第⼀、单表查询:根据WHERE条件过滤表中的记录,形成中间表(这个中间表对⽤户是不可见的);然后根据SELECT的选择列选择相应的列进⾏返回最终结果。
第⼆、两表连接查询:对两表求积(笛卡尔积)并⽤ON条件和连接连接类型进⾏过滤形成中间表;然后根据WHERE条件过滤中间表的记录,并根据SELECT指定的列返回查询结果。
第三、多表连接查询:先对第⼀个和第⼆个表按照两表连接做查询,然后⽤查询结果和第三个表做连接查询,以此类推,直到所有的表都连接上为⽌,最终形成⼀个中间的结果表,然后根据WHERE条件过滤中间表的记录,并根据SELECT指定的列返回查询结果。
理解SQL查询的过程是进⾏SQL优化的理论依据。
七、ON后⾯的条件(ON条件)和WHERE条件的区别:
ON条件:是过滤两个链接表笛卡尔积形成中间表的约束条件。
WHERE条件:在有ON条件的SELECT语句中是过滤中间表的约束条件。在没有ON的单表查询中,是限制物理表或者中间查询结果返回记录的约束。在两表或多表连接中是限制连接形成最终中间表的返回结果的约束。
从这⾥可以看出,将WHERE条件移⼊ON后⾯是不恰当的。推荐的做法是:
ON只进⾏连接操作,WHERE只过滤中间表的记录。
⼋、总结
连接查询是SQL查询的核⼼,连接查询的连接类型选择依据实际需求。如果选择不当,⾮但不能提⾼查询效率,反⽽会带来⼀些逻辑错误或者性能低下。下⾯总结⼀下两表连接查询选择⽅式的依据:
1、查两表关联列相等的数据⽤内连接。
2、 Col_L是Col_R的⼦集时⽤右外连接。
3、 Col_R是Col_L的⼦集时⽤左外连接。
4、 Col_R和Col_L彼此有交集但彼此互不为⼦集时候⽤全外。
5、求差操作的时候⽤联合查询。
多个表查询的时候,这些不同的连接类型可以写到⼀块。例如:
SELECT T1.C1,T2.CX,T3.CY
sql语句实现的四种功能FROM TAB1 T1
INNER JOIN TAB2 T2 ON (T1.C1=T2.C2)
INNER JOIN TAB3 T3 ON (T1.C1=T2.C3)
LEFT OUTER JOIN TAB4 ON(T2.C2=T3.C3);
WHERE T1.X >T3.Y;
上⾯这个SQL查询是多表连接的⼀个⽰范。
版权声明:本站内容均来自互联网,仅供演示用,请勿用于商业和其他非法用途。如果侵犯了您的权益请与我们联系QQ:729038198,我们将在24小时内删除。
发表评论