ABtest描述统计功效

统计功效是衡量AB测试中不犯二类错误的概率,即在真实存在差异时能正确识别的能力。错误分为两类:一类错误(α错误)是假阳性,即无差异时判断有差异;二类错误(β错误)是假阴性,即有差异时判断无差异。统计功效越高,当AB组确实有差异时,我们正确识别的概率越大。通常关注显著性水平α以避免假阳性,但高统计功效意味着更严格的实验要求和更大可能发现真实效应。
摘要由CSDN通过智能技术生成

我们在面试数据分析时,常常会问到如何确定样本量的问题,会有一个指标:统计功效(power),或者是1-β

统计功效会影响实验的可信度,甚至会影响实验所需的样本量,要了解统计功效,首先要理解两类统计错误

假如我们做了一个AB实验,且两组用户的数据均值为μ1和μ2,我们会有两个初始假设:

H0:两个实验组的数据没有差别(μ1=μ2),这个假设也叫“零假设”,也叫原假设

H1:两个实验组之间的数据存在差别(μ1≠μ2),这个假设也叫“非零假设”,也叫备择假设

定义两类错误:

实验本身没有效应,但我们觉得有效应。这是一类错误,或者叫α错误

实验本身有效应,但是我们误以为没有。这是二类错误,或者叫β错误

统计量临界值:

 在H0假设下,统计量有一个分布,如上图H0,当计算的统计量处于分布的小概率区域时,我们就可以说零假设是小概率事件,可以拒绝零假设。如图,当统计量大于2时,我们就可以拒绝H0,此时,我们犯第一类错误的概率就是α,换句话说,零假设是真的,我们却拒绝了它。

当我们设定了显著性水平时,α就确定了,一般为0.05&#

评论
添加红包

请填写红包祝福语或标题

红包个数最小为10个

红包金额最低5元

当前余额3.43前往充值 >
需支付:10.00
成就一亿技术人!
领取后你会自动成为博主和红包主的粉丝 规则
hope_wisdom
发出的红包
实付
使用余额支付
点击重新获取
扫码支付
钱包余额 0

抵扣说明:

1.余额是钱包充值的虚拟货币,按照1:1的比例进行支付金额的抵扣。
2.余额无法直接购买下载,可以购买VIP、付费专栏及课程。

余额充值