水池抽样算法

水塘抽样算法是一种在数据集中随机抽取样本的方法,确保每个元素被选中的概率相等。在随机选择一个数的过程中,随着更多人的到来,每个人被选中的概率为1/n。当需要从n个样本中平均抽取变化的k个数据时,该算法能适应k的变化。此算法在497题中用于非重叠矩形中选择点,通过比较随机数与矩形面积比例来保留矩形,实现与面积对应的保留概率。在Spark的RangePartitioner中,水塘抽样也有所应用。
摘要由CSDN通过智能技术生成

随机选择一个数

水池抽样

1.第一个人来了,抽奖概率就是1
2.第二个人来了,一共有两个人,他抽中概率为1/2, 那么第一个人抽中的概率就是 1 * 1/2 = 1/2;
3. 第三个人来了,那他抽中概率就是1/3,同理, 第一个第二个人抽中概率为 1/2 * 2/3 = 1/3;
。。。。。
就保证每个人来了之后抽中的概率就是1/n;

Random random = new Random(47);
        int n = 100;
        int indec = 0, count = 0;
        for (int i = 0; i < 100; i++) {
   
            count++;
            //如果某个人中奖就给他
            if (random.nextInt(count) == 1) indec = i;
        }

如果选择随机平均选择k个数据

// 从长度为n的nums数组中随机选取k个数(水塘抽样)
    public int[] Reservoir(int
评论
添加红包

请填写红包祝福语或标题

红包个数最小为10个

红包金额最低5元

当前余额3.43前往充值 >
需支付:10.00
成就一亿技术人!
领取后你会自动成为博主和红包主的粉丝 规则
hope_wisdom
发出的红包
实付
使用余额支付
点击重新获取
扫码支付
钱包余额 0

抵扣说明:

1.余额是钱包充值的虚拟货币,按照1:1的比例进行支付金额的抵扣。
2.余额无法直接购买下载,可以购买VIP、付费专栏及课程。

余额充值