(推薦一本書《程式員實用演算法》(Andrew Binstock / John Rex),網上有中文電子版,不過推薦買一本正版,這是一本經典書。)
1. 概述
排序演算法是電腦技術中最基本的演算法,許多複雜演算法都會用到排序。儘管各種排序演算法都已被封裝成庫函數供程式員使用,但瞭解排序演算法的思想和原理,對於編寫高品質的軟體,顯得非常重要。
本文介紹了常見的排序演算法,從演算法思想,複雜度和使用情境等方面做了總結。
2. 幾個概念
(1)排序穩定:如果兩個數相同,對他們進行的排序結果為他們的相對順序不變。例如A={1,2,1,2,1}這裡排序之後是A = {1,1,1,2,2} 穩定就是排序後第一個1就是排序前的第一個1,第二個1就是排序前第二個1,第三個1就是排序前的第三個1。同理2也是一樣。不穩定就是他們的順序與開始順序不一致。
(2)原地排序:指不申請多餘的空間進行的排序,就是在原來的排序資料中比較和交換的排序。例如快速排序,堆排序等都是原地排序,合并排序,計數排序等不是原地排序。
總體上說,排序演算法有兩種設計思路,一種是基於比較,另一種不是基於比較。《演算法導論》一書給出了這樣一個證明:“基於比較的演算法的最優時間複雜度是O(N lg N)”。對於基於比較的演算法,有三種設計思路,分別為:插入排序,交換排序和選擇排序。非基於比較的排序演算法時間複雜度為O(lg N),之所以複雜度如此低,是因為它們一般對排序資料有特殊要求。如計數排序要求資料範圍不會太大,基數排序要求資料可以分解成多個屬性等。
3. 基於比較的排序演算法
正如前一節介紹的,基於比較的排序演算法有三種設計思路,分別為插入,交換和選擇。對於插入排序,主要有直接插入排序,希爾排序;對於交換排序,主要有冒泡排序,快速排序;對於選擇排序,主要有簡單選擇排序,堆排序;其它排序:歸併排序。
3.1 插入排序
(1) 直接插入排序
特點:穩定排序,原地排序,時間複雜度O(N*N)
思想:將所有待排序資料分成兩個序列,一個是有序序列S,另一個是待排序序列U,初始時,S為空白,U為所有資料群組成的數列,然後依次將U中的資料插到有序序列S中,直到U變為空白。
適用情境:當資料已經基本有序時,採用插入排序可以明顯減少資料交換和資料移動次數,進而提升排序效率。
(2)希爾排序
特點:非穩定排序,原地排序,時間複雜度O(n^lamda)(1 < lamda < 2), lamda和每次步長選擇有關。
思想:增量縮小排序。先將序列按增量劃分為元素個數近似的若干組,使用直接插入排序法對每組進行排序,然後不斷縮小增量直至為1,最後使用直接插入排序完成排序。
適用情境:因為增量初始值不容易選擇,所以該演算法不常用。
3.2 交換排序
(1)冒泡排序
特點:穩定排序,原地排序,時間複雜度O(N*N)
思想:將整個序列分為無序和有序兩個子序列,不斷通過交換較大元素至無序子序列首完成排序。
適用情境:同直接插入排序類似
(2)快速排序
特點:不穩定排序,原地排序,時間複雜度O(N*lg N)
思想:不斷尋找一個序列的樞軸點,然後分別把小於和大於樞軸點的資料移到樞軸點兩邊,然後在兩邊數列中繼續這樣的操作,直至全部序列排序完成。
適用情境:應用很廣泛,差不多各種語言均提供了快排API
3.3 選擇排序
(1)簡單選擇排序
特點:不穩定排序(比如對3 3 2三個數進行排序,第一個3會與2交換),原地排序,時間複雜度O(N*N)
思想:將序列劃分為無序和有序兩個子序列,尋找無序序列中的最小(大)值和無序序列的首元素交換,有序區擴大一個,迴圈下去,最終完成全部排序。
適用情境:交換少
(2) 堆排序
特點:非穩定排序,原地排序,時間複雜度O(N*lg N)
思想:小頂堆或者大頂堆
適用情境:不如快排廣泛
3.4 其它排序
(1) 歸併排序
特點:穩定排序,非原地排序,時間複雜度O(N*N)
思想:首先,將整個序列(共N個元素)看成N個有序子序列,然後依次合并相鄰的兩個子序列,這樣一直下去,直至變成一個整體有序的序列。
適用情境:外部排序
4. 非基於比較的排序演算法
非基於比較的排序演算法主要有三種,分別為:基數排序,桶排序和計數排序。這些演算法均是針對特殊資料的,不如要求資料分布均勻,資料偏差不會太大。採用的思想均是記憶體換時間,因而全是非原地排序。
4.1 基數排序
特點:穩定排序,非原地排序,時間複雜度O(N)
思想:把每個資料看成d個屬性群組成,依次按照d個屬性對資料排序(每輪排序可採用計數排序),複雜度為O(d*N)
適用情境:資料明顯有幾個關鍵字或者幾個屬性群組成
4.2 桶排序
特點:穩定排序,非原地排序,時間複雜度O(N)
思想:將資料按大小分到若干個桶(比如鏈表)裡面,每個桶內部採用簡單排序演算法進行排序。
適用情境:0
4.3 計數排序
特點:穩定排序,非原地排序,時間複雜度O(N)
思想:對每個資料出現次數進行技術(用hash方法計數,最簡單的hash是數組。),然後從大到小或者從小到大輸出每個資料。
使用情境:比基數排序和桶排序廣泛得多。
5. 總結
對於基於比較的排序演算法,大部分簡單排序(直接插入排序,選擇排序和冒泡排序)都是穩定排序,選擇排序除外;大部分進階排序(除簡單排序以外的)都是不穩定排序,歸併排序除外,但歸併排序需要額外的儲存空間。對於非基於比較的排序演算法,它們都對資料規律有特殊要求 ,且採用了記憶體換時間的思想。排序演算法如此之多,往往需要根據實際應用選擇最適合的排序演算法。
6. 參考資料
(1)博文《排序演算法總結》:
http://www.cppblog.com/shongbee2/archive/2009/04/25/81058.html
(2)博文:《八大排序演算法》:
http://blog.csdn.net/yexinghai/archive/2009/10/10/4649923.aspx
———————————————————————————————-
更多關於資料結構和演算法的介紹,請查看:資料結構與演算法匯總
———————————————————————————————-
原創文章,轉載請註明: 轉載自董的部落格
本文連結地址: http://dongxicheng.org/structure/sort/