布隆过滤器java实现,Java手动实现布隆过滤器(BitSet)

1.首先我们需要:

一个合适大小的位数组保存数据     BitSet

几个不同的哈希函数      通过随机种子seed定制不同的hash函数

添加元素到位数组(布隆过滤器)的方法实现           add方法

判断给定元素是否存在于位数组(布隆过滤器)的方法实现。          contains方法

2.其次我们需验证布隆过滤器,判正可能出错的这一点,在代码中进行了实现

详情见注释:

import java.util.BitSet;

/**

* 布隆过滤器:用BitSet实现,建议先了解BitSet数据结构的常见方法。

*/

public class BloomFilter {

/**

* 位数组的大小

*/

// private static final int DEFAULT_SIZE = 2 << 24; 代表bitset中实际位数的总个数,这种情况个数很多很多基本布隆不会判断失误

private static final int DEFAULT_SIZE = 5; //只有5位的情况下,布隆容易判断错误。

/**

* 通过这个数组可以创建 6 个不同的哈希函数

*/

private static final int[] SEEDS = new int[]{3, 13, 46, 71, 91, 134};

/**

* 位数组。数组中的元素只能是 0 或者 1

*/

private BitSet bits = new BitSet(DEFAULT_SIZE);

/**

* 存放包含 hash 函数的类的数组

*/

private SimpleHash[] func = new SimpleHash[SEEDS.length];

/**

* 初始化多个包含 hash 函数的类的数组,每个类中的 hash 函数都不一样

*/

public BloomFilter() {

// 初始化多个不同的 Hash 函数

for (int i = 0; i < SEEDS.length; i++) {

func[i] = new SimpleHash(DEFAULT_SIZE, SEEDS[i]);

}

}

/**

* 添加元素到位数组

*/

public void add(Object value) {

for (SimpleHash f : func) {

bits.set(f.hash(value), true);

}

}

/**

* 判断指定元素是否存在于位数组

*/

public boolean contains(Object value) {

boolean ret = true;

for (SimpleHash f : func) {

ret = ret && bits.get(f.hash(value));

}

return ret;

}

/**

* 静态内部类。用于 hash 操作!

*/

public static class SimpleHash {

private int cap;

private int seed;

public SimpleHash(int cap, int seed) {

this.cap = cap;

this.seed = seed;

}

/**

* 计算 hash 值

*/

public int hash(Object value) {

int h;

return (value == null) ? 0 : Math.abs(seed * (cap - 1) & ((h = value.hashCode()) ^ (h >>> 16)));

//通过混入seed的值来产生5种不同的hash函数。

}

public static void main(String[] args) {

String value1 = "https://javaguide.cn/"; //故意混淆布隆过滤器,检测其准确性。

String value2 = "https://github.com/Snailclimb";//干扰准确性

String value3 = "https://jaavguide.cn/";

String value4 = "https://javaguie.cn/";

String value5 = "https://javaguid.cn/";

String value6 = "https://javagide.cn/";

String value10 = "https://javavguide.cn/";//这个值来检测 当布隆过滤器判断错误的情况

BloomFilter filter = new BloomFilter();

System.out.println(filter.contains(value1));

filter.add(value1);

filter.add(value2);

filter.add(value3);

filter.add(value4);

filter.add(value5);

filter.add(value6);

System.out.println(filter.contains(value1));

System.out.println(filter.contains(value3));

System.out.println(filter.contains(value10)); //这个值来检测 当布隆过滤器判断错误的情况

//输出true即为判断失误的情况。

}

}

}

dbd9fb150f8189de8ee9173b5c121fc5.png

4a668feaa3018a2e1706f07e5002bcc8.png

TheGreatKe

发布了12 篇原创文章 · 获赞 3 · 访问量 591

私信

关注

标签:Java,String,布隆,filter,add,BitSet,https,过滤器,cn

来源: https://blog.csdn.net/qq_41785467/article/details/104094217

  • 0
    点赞
  • 0
    收藏
    觉得还不错? 一键收藏
  • 0
    评论
评论
添加红包

请填写红包祝福语或标题

红包个数最小为10个

红包金额最低5元

当前余额3.43前往充值 >
需支付:10.00
成就一亿技术人!
领取后你会自动成为博主和红包主的粉丝 规则
hope_wisdom
发出的红包
实付
使用余额支付
点击重新获取
扫码支付
钱包余额 0

抵扣说明:

1.余额是钱包充值的虚拟货币,按照1:1的比例进行支付金额的抵扣。
2.余额无法直接购买下载,可以购买VIP、付费专栏及课程。

余额充值