布隆过滤器学习笔记

布隆过滤器的基本概念

历史

布隆过滤器(英语:Bloom Filter)是1970年由布隆提出的。它实际上是一个很长的 二进制向量一系列随机映射函数 。布隆过滤器可以用于检索一个元素是否在一个集合中。它的优点是空间效率和查询时间都远远超过一般的算法,缺点是有一定的 误识别率删除困难[维基百科]

要解决的问题

如果想判断一个元素是不是在一个集合里,一般想到的是将集合中所有元素保存起来,然后通过比较确定。链表、树、散列表(又叫哈希表,Hash table)等等数据结构都是这种思路,三者的检索时间复杂度分别为O(n)、O(logn)、O(1)。但是随着集合中元素的增加,我们需要的存储空间越来越大。同时检索速度也越来越慢[维基百科]

解决的思路

布隆过滤器的原理是,当一个元素被加入集合时,通过K个散列函数将这个元素映射成一个位数组中的K个点,把它们置为1。检索时,我们只要看看这些点是不是都是1就(大约)知道集合中有没有它了[维基百科]
① 如果出现0,则被检元素一定不在
② 如果都是1,则被检元素很可能在

优点

  1. 相比于其他数据结构,在时间和空间方面都有巨大优势(时空复杂度都为O(k)
  2. 不需要储存元素本身,有较好的保密性
  3. 可以表示全集,但其他数据结构不能

缺点

  1. 误算率。随着存入元素数量的增加,误算率增加。(如果元素少,可以考虑使用散列表)。因此出现了很多降低误算率的布隆过滤器变种。
  2. 不能删除元素。保证安全地删除元素并非如此简单。从布隆过滤器的设计概念来看,它无法保证元素一定存在。
  • 0
    点赞
  • 0
    收藏
    觉得还不错? 一键收藏
  • 0
    评论

“相关推荐”对你有帮助么?

  • 非常没帮助
  • 没帮助
  • 一般
  • 有帮助
  • 非常有帮助
提交
评论
添加红包

请填写红包祝福语或标题

红包个数最小为10个

红包金额最低5元

当前余额3.43前往充值 >
需支付:10.00
成就一亿技术人!
领取后你会自动成为博主和红包主的粉丝 规则
hope_wisdom
发出的红包
实付
使用余额支付
点击重新获取
扫码支付
钱包余额 0

抵扣说明:

1.余额是钱包充值的虚拟货币,按照1:1的比例进行支付金额的抵扣。
2.余额无法直接购买下载,可以购买VIP、付费专栏及课程。

余额充值