原文地址:http://antirez.com/post/take-advantage-of-redis-adding-it-to-your-stack.html
Redis在很多方面與其他資料庫解決方案不同:它使用記憶體提供主儲存支援,而僅使用硬碟做持久性的儲存;它的資料模型非常獨特,用的是單線
程。另一個大區別在於,你可以在開發環境中使用Redis的功能,但卻不需要轉到Redis。
轉向Redis當然也是可取的,許多開發人員從一開始就把Redis作為首選資料庫;但設想如果你的開發環境已經搭建好,應用已經在上面運行了,那麼更換資料庫架構顯然不那麼容易。另外在一些需要大容量資料集的應用,Redis也並不適合,因為它的資料集不會超過系統可用的記憶體。所以如果你有大資料應用,而且主要是讀取存取模式,那麼Redis並不是正確的選擇。
然而我喜歡Redis的一點就是你可以把它融入到你的系統中來,這就能夠解決很多問題,比如那些你現有的資料庫處理起來感到緩慢的任務。這些你就可以通過Redis來進行最佳化,或者為應用建立些新的功能。在本文中,我就想探討一些怎樣將Redis加入到現有的環境中,並利用它的原語命令等功能來解決傳統環境中碰到的一些常見問題。在這些例子中,Redis都不是作為首選資料庫。 1. 顯示最新的項目列表
下面這個語句常用來顯示最新項目,隨著資料多了,查詢毫無疑問會越來越慢。下面這個語句常用來顯示最新項目,隨著資料多了,查詢毫無疑問會越來越慢。
SELECT * FROM foo WHERE ... ORDER BY time DESC LIMIT 10
在Web應用中,“列出最新的回複”之類的查詢非常普遍,這通常會帶來可擴充性問題。這令人沮喪,因為項目本來就是按這個順序被建立的,但要輸出這個順序卻不得不進行排序操作。
類似的問題就可以用Redis來解決。比如說,我們的一個Web應用想要列出使用者貼出的最新20條評論。在最新的評論邊上我們有一個“顯示全部”的連結,點擊後就可以獲得更多的評論。
我們假設資料庫中的每條評論都有一個唯一的遞增的ID欄位。
我們可以使用分頁來製作首頁和評論頁,使用Redis的模板:
-每次新評論發表時,我們會將它的ID添加到一個Redis列表:
LPUSH latest.comments <ID>
我們將列表裁剪為指定長度,因此Redis只需要儲存最新的5000條評論:
LTRIM latest.comments 0 5000
-每次我們需要擷取最新評論的專案範圍時,我們調用一個函數來完成(使用虛擬碼):
FUNCTION get_latest_comments(start,num_items): id_list = redis.lrange("latest.comments",start,start+num_items-1) IF id_list.length < num_items id_list = SQL_DB("SELECT ... ORDER BY time LIMIT ...") END RETURN id_list END
這裡我們做的很簡單。在Redis中我們的最新ID使用了常駐緩衝,這是一直更新的。但是我們做了限制不能超過5000個ID,因此我們的擷取ID函數會一直詢問Redis。只有在start/count參數超出了這個範圍的時候,才需要去訪問資料庫。
我們的系統不會像傳統方式那樣“重新整理”緩衝,Redis執行個體中的資訊永遠是一致的。SQL資料庫(或是硬碟上的其他類型資料庫)只是在使用者需要擷取“很遠”的資料時才會被觸發,而首頁或第一個評論頁是不會麻煩到硬碟上的資料庫了。 刪除與過濾
我們可以使用LREM來刪除評論。如果刪除操作非常少,另一個選擇是直接跳過評論條目的入口,報告說該評論已經不存在。
有些時候你想要給不同的列表附加上不同的過濾器。如果過濾器的數量受到限制,你可以簡單的為每個不同的過濾器使用不同的Redis列表。畢竟每個列表只有5000條項目,但Redis卻能夠使用非常少的記憶體來處理幾百萬條項目。 熱門排行榜相關
另一個很普遍的需求是各種資料庫的資料並非儲存在記憶體中,因此在按得分排序以及即時更新這些幾乎每秒鐘都需要更新的功能上資料庫的效能不夠理想。
典型的比如那些線上遊戲的熱門排行榜,比如一個Facebook的遊戲,根據得分你通常想要:
-列出前100名高分選手
-列出某使用者當前的全球排名
這些操作對於Redis來說小菜一碟,即使你有幾百萬個使用者,每分鐘都會有幾百萬個新的得分。
模式是這樣的,每次獲得新得分時,我們用這樣的代碼:
ZADD leaderboard <score> <username>
你可能用userID來取代username,這取決於你是怎麼設計的。
得到前100名高分使用者很簡單:ZREVRANGE leaderboard 0 99。
使用者的全球排名也相似,只需要:ZRANK leaderboard <username>。 按照使用者投票和時間排序
熱門排行榜的一種常見變體模式就像Reddit或Hacker News用的那樣,新聞按照類似下面的公式根據得分來排序:
score = points / time^alpha
因此使用者的投票會相應的把新聞挖出來,但時間會按照一定的指數將新聞埋下去。下面是我們的模式,當然演算法由你決定。
模式是這樣的,開始時先觀察那些可能是最新的項目,例如首頁上的1000條新聞都是候選者,因此我們先忽視掉其他的,這實現起來很簡單。
- 每次新的新聞貼上來後,我們將ID添加到列表中,使用LPUSH + LTRIM,確保只取出最新的1000條項目。
- 有一項背景工作擷取這個列表,並且持續的計算這1000條新聞中每條新聞的最終得分。計算結果由ZADD命令按照新的順序填充產生列表,老新聞則被清除。這裡的關鍵思路是排序工作是由背景工作來完成的。 到期項目處理
另一種常用的項目排序是按照時間排序。我們使用unix時間作為得分即可。
模式如下:
- 每次有新項目添加到我們的非Redis資料庫時,我們把它加入到排序集合中。這時我們用的是時間屬性,current_time和time_to_live。
- 另一項背景工作使用ZRANGE…SCORES查詢排序集合,取出最新的10個項目。如果發現unix時間已經到期,則在資料庫中刪除條目。 計數
Redis是一個很好的計數器,這要感謝INCRBY和其他相似命令。
我相信你曾許多次想要給資料庫加上新的計數器,用來擷取統計或顯示新資訊,但是最後卻由於寫入敏感而不得不放棄它們。
好了,現在使用Redis就不需要再擔心了。有了原子遞增(atomic increment),你可以放心的加上各種計數,用GETSET重設,或者是讓它們到期。
例如這樣操作: INCR user:<id> EXPIRE user:<id> 60 你可以計算出最近使用者在頁面間停頓不超過60秒的頁面瀏覽量,當計數達到比如20時,就可以顯示出某些條幅提示,或是其它你想顯示的東西。