2.9 什么是A/B测试？如何进行A/B测试？

最新推荐文章于 2024-06-12 17:02:51 发布

seasonsyy

最新推荐文章于 2024-06-12 17:02:51 发布

阅读量795

点赞数 11

分类专栏：《百面机器学习》文章标签： A/B测试实验组对照组评估模型

本文链接：https://blog.csdn.net/seasonsyy/article/details/136964742

版权

《百面机器学习》专栏收录该内容

18 篇文章 0 订阅

订阅专栏

2.9 什么是A/B测试？

场景描述
在互联网公司中，A/B 测试是验证新模块、新功能、新产品是否有效，新算法、新模型的效果是否有提升，新设计是否受到用户欢迎，新更改是否影响用户体验的主要测试方法。在机器学习领域中，A/B 测试是验证模型最终效果的主要手段。
知识点
A/B 测试,实验组,对照组

在对模型进行过充分的离线评估之后，为什么还要进行在线A/B 测试?

需要进行在线A/B 测试的原因如下。

离线评估无法完全消除模型过拟合的影响，因此，得出的离线评估结果无法完全替代线上评估结果。
离线评估无法完全还原线上的工程环境。一般来讲，离线评估往往不会考虑线上环境的延迟、数据丢失、标签数据缺失等情况。因此，离线评估的结果是理想工程环境下的结果。
线上系统的某些商业指标在离线评估中无法计算。离线评估一般是针对模型本身进行评估，而与模型相关的其他指标，特别是商业指标，往往无法直接获得。比如，上线了新的推荐算法，离线评估往往关注的是ROC曲线、P-R曲线等的改进，而线上评估可以全面了解该推荐算法带来的用户点击率、留存时长、PV访问量等的变化。这些都要由A/B测试来进行全面的评估。

如何进行线上A/B测试?

进行A/B 测试的主要手段是进行用户分桶，即将用户分成实验组和对照组，对实验组的用户施以新模型，对对照组的用户施以旧模型。在分桶的过程中，要注意样本的独立性和采样方式的无偏性，确保同一个用户每次只能分到同一个桶中，在分桶过程中所选取的user_id需要是一个随机数，这样才能保证桶中的样本是无偏的。