-智聚问答

两者都能实现表功能查询，主要区别如下： 1、适用表的类型不同。 in是子查询为驱动表，外面的表为被驱动表，故适用于子查询结果集小而外面的表结果集大的情况。 exists是外面的表位驱动表，子查询里面的表为被驱动表，故适用于外面的表结果集小而子查询结果集大的情况。 2、子查询关联不同。 exists一般都是关联子查询。对于关联子查询，必须先执行外层查询，接着对所有通过过滤条件的记录，执行内层查询。外层查询和内层查询相互依赖，因为外层查询会把数据传递给内层查询。 in则一般都是非关联子查询，非关联子查询则必须先完成内层查询之后，外层查询才能介入。 3、执行次数不同。 IN 语句：只执行一次，确定给定的值是否与子查询或列表中的值相匹配。in在查询的时候，首先查询子查询的表，然后将内表和外表做一个笛卡尔积，然后按照条件进行筛选。所以相对内表比较小的时候，in的速度较快。 EXISTS语句：执行次数根据表的长度而定。指定一个子查询，检测行的存在。遍历循环外表，然后看外表中的记录有没有和内表的数据一样的。匹配上就将结果放入结果集中。参考资料来源：百度百科--In操作符参考资料来源：百度百科--Exists

2019-11-11 19:17:04

本文主要分析了in和exists的区别与执行效率的问题： in可以分为三类： 1、形如select * from t1 where f1 in ( 'a ', 'b ')，应该和以下两种比较效率。 select * from t1 where f1= 'a ' or f1= 'b ' 或者 select * from t1 where f1 = 'a ' union all select * from t1 f1= 'b ' 你可能指的不是这一类，这里不做讨论。 2、形如 select * from t1 where f1 in (select f1 from t2 where t2.fx= 'x ')，其中子查询的where里的条件不受外层查询的影响，这类查询一般情况下，自动优化会转成exist语句，也就是效率和exist一样。 3、形如 select * from t1 where f1 in (select f1 from t2 where t2.fx=t1.fx)，其中子查询的where里的条件受外层查询的影响，这类查询的效率要看相关条件涉及的字段的索引情况和数据量多少，一般认为效率不如exists。除了第一类in语句都是可以转化成exists 语句的，一般编程习惯应该是用exists而不用in. A，B两个表， (1)当只显示一个表的数据如A，关系条件只一个如ID时，使用IN更快： select * from A where id in (select id from B) (2)当只显示一个表的数据如A，关系条件不只一个如ID，col1时，使用IN就不方便了，可以使用EXISTS： select * from Awhere exists (select 1 from B where id = A.id and col1 = A.col1) (3)当只显示两个表的数据时，使用IN，EXISTS都不合适，要使用连接： select * from A left join B on id = A.id 所以使用何种方式，要根据要求来定。这是一般情况下做的测试：测试结果: set statistics io on select * from sysobjects where exists (select 1 from syscolumns where id=syscolumns.id) select * from sysobjects where id in (select id from syscolumns ) set statistics io off (47 行受影响) 表 'syscolpars '。扫描计数 1，逻辑读取 3 次，物理读取 0 次，预读 2 次，lob 逻辑读取 0 次，lob 物理读取 0 次，lob 预读 0 次。表 'sysschobjs '。扫描计数 1，逻辑读取 3 次，物理读取 0 次，预读 0 次，lob 逻辑读取 0 次，lob 物理读取 0 次，lob 预读 0 次。 (1 行受影响) (44 行受影响) 表 'syscolpars '。扫描计数 47，逻辑读取 97 次，物理读取 0 次，预读 0 次，lob 逻辑读取 0 次，lob 物理读取 0 次，lob 预读 0 次。表 'sysschobjs '。扫描计数 1，逻辑读取 3 次，物理读取 0 次，预读 0 次，lob 逻辑读取 0 次，lob 物理读取 0 次，lob 预读 0 次。 (1 行受影响) set statistics io on select * from syscolumns where exists (select 1 from sysobjects where id=syscolumns.id) select * from syscolumns where id in (select id from sysobjects ) set statistics io off (419 行受影响) 表 'syscolpars '。扫描计数 1，逻辑读取 10 次，物理读取 0 次，预读 15 次，lob 逻辑读取 0 次，lob 物理读取 0 次，lob 预读 0 次。表 'sysschobjs '。扫描计数 1，逻辑读取 3 次，物理读取 0 次，预读 0 次，lob 逻辑读取 0 次，lob 物理读取 0 次，lob 预读 0 次。 (1 行受影响) (419 行受影响) 表 'syscolpars '。扫描计数 1，逻辑读取 10 次，物理读取 0 次，预读 0 次，lob 逻辑读取 0 次，lob 物理读取 0 次，lob 预读 0 次。表 'sysschobjs '。扫描计数 1，逻辑读取 3 次，物理读取 0 次，预读 0 次，lob 逻辑读取 0 次，lob 物理读取 0 次，lob 预读 0 次。 (1 行受影响) 测试结果(总体来讲exists比in的效率高): 效率:条件因素的索引是非常关键的把syscolumns 作为条件:syscolumns 数据大于sysobjects 用in 扫描计数 47，逻辑读取 97 次，用exists 扫描计数 1，逻辑读取 3 次把sysobjects作为条件:sysobjects的数据少于syscolumns exists比in多预读 15 次

2017-11-28 23:38:19

sql中in和exist语句的区别？

SQL语句中 in和exist区别