国产探花免费观看_亚洲丰满少妇自慰呻吟_97日韩有码在线_资源在线日韩欧美_一区二区精品毛片,辰东完美世界有声小说,欢乐颂第一季,yy玄幻小说排行榜完本

首頁(yè) > 數(shù)據(jù)庫(kù) > Redis > 正文

Redis實(shí)現(xiàn)唯一計(jì)數(shù)的3種方法分享

2020-10-28 21:41:43
字體:
來(lái)源:轉(zhuǎn)載
供稿:網(wǎng)友

唯一計(jì)數(shù)是網(wǎng)站系統(tǒng)中十分常見(jiàn)的一個(gè)功能特性,例如網(wǎng)站需要統(tǒng)計(jì)每天訪問(wèn)的人數(shù) unique visitor (也就是 UV)。計(jì)數(shù)問(wèn)題很常見(jiàn),但解決起來(lái)可能十分復(fù)雜:一是需要計(jì)數(shù)的量可能很大,比如大型的站點(diǎn)每天有數(shù)百萬(wàn)的人訪問(wèn),數(shù)據(jù)量相當(dāng)大;二是通常還希望擴(kuò)展計(jì)數(shù)的維度,比如除了需要每天的 UV,還想知道每周或每月的 UV,這樣導(dǎo)致計(jì)算十分復(fù)雜。

在關(guān)系數(shù)據(jù)庫(kù)存儲(chǔ)的系統(tǒng)里,實(shí)現(xiàn)唯一計(jì)數(shù)的方法就是 select count(distinct <item_id>),它十分簡(jiǎn)單,但是如果數(shù)據(jù)量很大,這個(gè)語(yǔ)句執(zhí)行是很慢的。用關(guān)系數(shù)據(jù)庫(kù)另外一個(gè)問(wèn)題是插入數(shù)據(jù)性能也不高。

Redis 解決這類計(jì)數(shù)問(wèn)題得心應(yīng)手,相比關(guān)系數(shù)據(jù)庫(kù)速度更快,消耗資源更少,甚至提供了 3 種不同的方法。

1.基于 set

Redis 的 set 用于保存唯一的數(shù)據(jù)集合,通過(guò)它可以快速判斷某一個(gè)元素是否存在于集合中,也可以快速計(jì)算某一個(gè)集合的元素個(gè)數(shù),另外和可以合并集合到一個(gè)新的集合中。涉及的命令如下:

復(fù)制代碼 代碼如下:

SISMEMBER key member  # 判斷 member 是否存在
SADD key member  # 往集合中加入 member
SCARD key   # 獲取集合元素個(gè)數(shù)

基于 set 的方法簡(jiǎn)單有效,計(jì)數(shù)精確,適用面廣,易于理解,它的缺點(diǎn)是消耗資源比較大(當(dāng)然比起關(guān)系數(shù)據(jù)庫(kù)是少很多的),如果元素個(gè)數(shù)很大(比如上億的計(jì)數(shù)),消耗內(nèi)存很恐怖。

2.基于 bit

Redis 的 bit 可以用于實(shí)現(xiàn)比 set 內(nèi)存高度壓縮的計(jì)數(shù),它通過(guò)一個(gè) bit 1 或 0 來(lái)存儲(chǔ)某個(gè)元素是否存在信息。例如網(wǎng)站唯一訪客計(jì)數(shù),可以把 user_id 作為 bit 的偏移量 offset,設(shè)置為 1 表示有訪問(wèn),使用 1 MB的空間就可以存放 800 多萬(wàn)用戶的一天訪問(wèn)計(jì)數(shù)情況。涉及的命令如下:

復(fù)制代碼 代碼如下:

SETBIT key offset value  # 設(shè)置位信息
GETBIT key offset        # 獲取位信息
BITCOUNT key [start end] # 計(jì)數(shù)
BITOP operation destkey key [key ...]  # 位圖合并

基于 bit 的方法比起 set 空間消耗小得多,但是它要求元素能否簡(jiǎn)單映射為位偏移,適用面窄了不少,另外它消耗的空間取決于最大偏移量,和計(jì)數(shù)值無(wú)關(guān),如果最大偏移量很大,消耗內(nèi)存也相當(dāng)可觀。

3.基于 HyperLogLog

實(shí)現(xiàn)超大數(shù)據(jù)量精確的唯一計(jì)數(shù)都是比較困難的,但是如果只是近似的話,計(jì)算科學(xué)里有很多高效的算法,其中 HyperLogLog Counting 就是其中非常著名的算法,它可以僅僅使用 12 k左右的內(nèi)存,實(shí)現(xiàn)上億的唯一計(jì)數(shù),而且誤差控制在百分之一左右。涉及的命令如下:

復(fù)制代碼 代碼如下:

PFADD key element [element ...]  # 加入元素
PFCOUNT key [key ...]   # 計(jì)數(shù)

這種計(jì)數(shù)方法真的很神奇,我也沒(méi)有徹底弄明白,有興趣可以深入研究相關(guān)文章。

redis 提供的這三種唯一計(jì)數(shù)方式各有優(yōu)劣,可以充分滿足不同情況下的計(jì)數(shù)要求。

發(fā)表評(píng)論 共有條評(píng)論
用戶名: 密碼:
驗(yàn)證碼: 匿名發(fā)表
主站蜘蛛池模板: 大宁县| 历史| 彭山县| 库伦旗| 偃师市| 云安县| 沙洋县| 三穗县| 和田市| 宁都县| 永嘉县| 阿鲁科尔沁旗| 乌兰察布市| 高碑店市| 府谷县| 舞阳县| 汶川县| 上杭县| 报价| 富裕县| 东台市| 乌兰察布市| 西乡县| 深圳市| 绥中县| 马公市| 安岳县| 萝北县| 拉孜县| 浮梁县| 扎囊县| 孝义市| 三门县| 禹城市| 大竹县| 花莲市| 盈江县| 井冈山市| 普兰店市| 舒兰市| 兖州市|