一:in和existsin 是把外表和內表作hash 串連,而exists是對外表作loop迴圈,每次loop迴圈再對內表進行查詢。一直以來認為exists比in效率高的說法是不準確的。A:如果從邏輯上來看,這兩條語句in執行的是非相互關聯的子查詢,子查詢內容不必隨外部主查詢每進行一行而重新執行,而後緩衝子查詢結果,主查詢中的每一行與這個子查詢結果進行匹配比較。exists 執行的是相互關聯的子查詢,子查詢內容每執行外部主查詢一行,子查詢都要重新執行。從上面的分析來看,如果in後的結果集越小,那麼in就越快,與通常說的exists快於in是相反的,即二者未必誰效率高,依賴於具體資料下的匹配率(當然,這裡說的是邏輯上)B: 實際執行上來說,sql查詢最佳化工具對二者進行執行最佳化,會產生同樣的執行計畫,所以沒有區別。
1. 如果查詢的兩個表大小相當,那麼用in和exists差別不大。
2. 如果兩個表中一個較小,一個是大表,則子查詢表大的用exists,子查詢表小的用in:
例如:表A(小表),表B(大表):select * from A where cc in (select cc from B)
效率低,用到了A表上cc列的索引;select * from A where exists(select cc from B where cc=A.cc)
效率高,用到了B表上cc列的索引。
相反的2:select * from B where cc in (select cc from A)
效率高,用到了B表上cc列的索引;select * from B where exists(select cc from A where cc=B.cc)
效率低,用到了A表上cc列的索引。
二:not in 和not exists
not in 和not exists如果查詢語句使用了not in 那麼內外表都進行全表掃描,沒有用到索引;而not extsts 的子查詢依然能用到表上的索引。
所以無論哪個表大,用not exists都比not in要快。
三:in 與 =的區別
select name from student where name in ('zhang','wang','li','zhao');
與
select name from student where name='zhang' or name='li' or name='wang' or name='zhao'的結果是相同的。