布隆过滤器

最新推荐文章于 2021-06-22 15:45:07 发布

若水冷

最新推荐文章于 2021-06-22 15:45:07 发布

阅读量493

点赞数

版权声明：本文为博主原创文章，遵循 CC 4.0 BY-SA 版权协议，转载请附上原文出处链接和本声明。

本文链接：https://blog.csdn.net/zlc521520/article/details/108393635

版权

什么是布隆过滤器？

本质上布隆过滤器是一种数据结构，比较巧妙的概率型数据结构（probabilistic data structure），特点是高效地插入和查询，可以用来告诉你 “某样东西一定不存在或者可能存在”。

相比于传统的 List、Set、Map 等数据结构，它更高效、占用空间更少，但是缺点是其返回的结果是概率性的，而不是确切的。

布隆过滤器出现的背景？

假设要判断一个id值是否存在，在不查询数据库的情况下，从一个上亿条数据量的表中得出是否存在该id值的结论。

出现的问题：把所有的id值都缓冲到内存中，然后遍历，但是内存是有限的，太耗内存，实际情况也没有这么打的内存，而且这里只是判断了容量小的id值，要是判断表中某个大字段列，都是不可能在内存中加载成功的。

解决的方案：
1：现在创建一个bit数组数据每项值初始化都是0。
2：此时不再是存储表中每个id值，而是把每个id值通过给定的hash()方法计算后，得到一个bit数组的角标，把这个bit数组角标对应的值修改为1。
3：现在客户端给定一个id值，我们也把这个id值执行hash（）方法得到对应的角标，看此角标的值，是否为1，是1表示存在，为0，表示不存在。
4：我们发现一个hash()方法得到角标标识一个唯一id值，不太准确，如果对一个id值，通过多个hash()方法获取的一个角标集合都设置

最低0.47元/天解锁文章

关注

0
点赞
踩
1

收藏

觉得还不错? 一键收藏
0
评论
布隆过滤器

什么是布隆过滤器？本质上布隆过滤器是一种数据结构，比较巧妙的概率型数据结构（probabilistic data structure），特点是高效地插入和查询，可以用来告诉你 “某样东西一定不存在或者可能存在”。相比于传统的 List、Set、Map 等数据结构，它更高效、占用空间更少，但是缺点是其返回的结果是概率性的，而不是确切的。布隆过滤器出现的背景？假设要判断一个id值是否存在，在不查询数据库的情况下，从一个上亿条数据量的表中得出是否存在该id值的结论。出现的问题：把所有的id值都缓冲到内存
复制链接

扫一扫

评论

被折叠的条评论为什么被折叠?

到【灌水乐园】发言

查看更多评论

添加红包

成就一亿技术人!

hope_wisdom

发出的红包

实付元

使用余额支付

点击重新获取

扫码支付

钱包余额 0

抵扣说明：

1.余额是钱包充值的虚拟货币，按照1:1的比例进行支付金额的抵扣。
2.余额无法直接购买下载，可以购买VIP、付费专栏及课程。