Redis實(shí)現(xiàn)唯一計(jì)數(shù)的3種方法分享

2020-02-17 14:56:38

字體：大中小

供稿：網(wǎng)友

唯一計(jì)數(shù)是網(wǎng)站系統(tǒng)中十分常見(jiàn)的一個(gè)功能特性，例如網(wǎng)站需要統(tǒng)計(jì)每天訪問(wèn)的人數(shù) unique visitor （也就是 UV）。計(jì)數(shù)問(wèn)題很常見(jiàn)，但解決起來(lái)可能十分復(fù)雜：一是需要計(jì)數(shù)的量可能很大，比如大型的站點(diǎn)每天有數(shù)百萬(wàn)的人訪問(wèn)，數(shù)據(jù)量相當(dāng)大；二是通常還希望擴(kuò)展計(jì)數(shù)的維度，比如除了需要每天的 UV，還想知道每周或每月的 UV，這樣導(dǎo)致計(jì)算十分復(fù)雜。

在關(guān)系數(shù)據(jù)庫(kù)存儲(chǔ)的系統(tǒng)里，實(shí)現(xiàn)唯一計(jì)數(shù)的方法就是 select count(distinct )，它十分簡(jiǎn)單，但是如果數(shù)據(jù)量很大，這個(gè)語(yǔ)句執(zhí)行是很慢的。用關(guān)系數(shù)據(jù)庫(kù)另外一個(gè)問(wèn)題是插入數(shù)據(jù)性能也不高。

Redis 解決這類(lèi)計(jì)數(shù)問(wèn)題得心應(yīng)手，相比關(guān)系數(shù)據(jù)庫(kù)速度更快，消耗資源更少，甚至提供了 3 種不同的方法。

1.基于 set

Redis 的 set 用于保存唯一的數(shù)據(jù)集合，通過(guò)它可以快速判斷某一個(gè)元素是否存在于集合中，也可以快速計(jì)算某一個(gè)集合的元素個(gè)數(shù)，另外和可以合并集合到一個(gè)新的集合中。涉及的命令如下：

SISMEMBER key member? # 判斷 member 是否存在
SADD key member? # 往集合中加入 member
SCARD key?? # 獲取集合元素個(gè)數(shù) 

基于 set 的方法簡(jiǎn)單有效，計(jì)數(shù)精確，適用面廣，易于理解，它的缺點(diǎn)是消耗資源比較大（當(dāng)然比起關(guān)系數(shù)據(jù)庫(kù)是少很多的），如果元素個(gè)數(shù)很大（比如上億的計(jì)數(shù)），消耗內(nèi)存很恐怖。

2.基于 bit

Redis 的 bit 可以用于實(shí)現(xiàn)比 set 內(nèi)存高度壓縮的計(jì)數(shù)，它通過(guò)一個(gè) bit 1 或 0 來(lái)存儲(chǔ)某個(gè)元素是否存在信息。例如網(wǎng)站唯一訪客計(jì)數(shù)，可以把 user_id 作為 bit 的偏移量 offset，設(shè)置為 1 表示有訪問(wèn)，使用 1 MB的空間就可以存放 800 多萬(wàn)用戶的一天訪問(wèn)計(jì)數(shù)情況。涉及的命令如下：

SETBIT key offset value? # 設(shè)置位信息
GETBIT key offset??????? # 獲取位信息
BITCOUNT key [start end] # 計(jì)數(shù)
BITOP operation destkey key [key ...]? # 位圖合并 

基于 bit 的方法比起 set 空間消耗小得多，但是它要求元素能否簡(jiǎn)單映射為位偏移，適用面窄了不少，另外它消耗的空間取決于最大偏移量，和計(jì)數(shù)值無(wú)關(guān)，如果最大偏移量很大，消耗內(nèi)存也相當(dāng)可觀。

3.基于 HyperLogLog

實(shí)現(xiàn)超大數(shù)據(jù)量精確的唯一計(jì)數(shù)都是比較困難的，但是如果只是近似的話，計(jì)算科學(xué)里有很多高效的算法，其中 HyperLogLog Counting 就是其中非常著名的算法，它可以僅僅使用 12 k左右的內(nèi)存，實(shí)現(xiàn)上億的唯一計(jì)數(shù)，而且誤差控制在百分之一左右。涉及的命令如下：

PFADD key element [element ...]? # 加入元素
PFCOUNT key [key ...]?? # 計(jì)數(shù)

這種計(jì)數(shù)方法真的很神奇，我也沒(méi)有徹底弄明白，有興趣可以深入研究相關(guān)文章。

redis 提供的這三種唯一計(jì)數(shù)方式各有優(yōu)劣，可以充分滿足不同情況下的計(jì)數(shù)要求。

上一篇：Redis總結(jié)筆記（一）：安裝和常用命令

下一篇：NoSQL和Redis簡(jiǎn)介及Redis在Windows下的安裝和使用教程

學(xué)習(xí)交流

筆記本開(kāi)機(jī)提示error loading os錯(cuò)誤的問(wèn)

筆記本開(kāi)機(jī)提示error loading os錯(cuò)誤的問(wèn)題怎么解決...

熱門(mén)圖片

猜你喜歡的新聞

猜你喜歡的關(guān)注

新聞熱點(diǎn)

明兮語(yǔ)文停止運(yùn)營(yíng) 發(fā)展資金鏈斷裂

2020-02-16 09:52:44

2006年李俊編寫(xiě)了“熊貓燒香”電腦病毒，現(xiàn)在過(guò)得怎么樣？

2020-02-15 15:53:44

谷歌合并Alphabet旗下子公司Jigsaw，未來(lái)會(huì)如何發(fā)展？

2020-02-11 22:02:38

NASA說(shuō)今天地球引力最小能讓掃帚立起來(lái)？原因很簡(jiǎn)單

2020-02-11 21:45:12

TCL集團(tuán)宣布今日起正式更名為“TCL科技”

2020-02-07 10:36:18

黑莓曲終落，情懷價(jià)幾何？

2020-02-06 12:16:44

疑難解答

圖片精選

網(wǎng)友關(guān)注

麻豆小视频在线观看_中文黄色一级片_久久久成人精品_成片免费观看视频大全_午夜精品久久久久久久99热浪潮_成人一区二区三区四区

Redis實(shí)現(xiàn)唯一計(jì)數(shù)的3種方法分享