查看: 522| 回复: 0
跳转到指定楼层
上一主题 下一主题
收起左侧

[找工就业] A/B Test Case 求助 求讨论

全局:

2022(10-12月)-DataScience/Analytics硕士+3-5年 | 内推|BayArea湾区 分析|数据科学类全职@

注册一亩三分地论坛,查看更多干货!

您需要 登录 才可以下载或查看附件。没有帐号?注册账号

x
最近看到一个A/B Test的case,遇到几个疑惑,想来地里集思广益,求助一下大家!

Background: 假设某购物网站开发了一个新的search algorithm,认为这个新的算法可以大大提高搜索准确度。Product team launch了一个A/B test,A是control,B是采用新搜索算法的test group。有一组数据,现在让帮助分析实验结果,并给出建议。

问题:
1. User level vs. action level metric哪个更好?我觉得两个各有各的优势,但最终觉得用user level比较好,但并不太能说得出理由…
  • User level: # of users clicked / # of users searched
  • Action level: # of clicked result / # of search

2. Success metric:这里最直接的metric是take了search action的user的 CTR = # of users clicked / # of users searched,但这只是最表层的metric。launch新search算法的最终目的肯定是能让用户找到自己需要的商品并购买,所以下游的metrics也很重要。我选了这3个metrics,并用了bonferroni correction。在实际做A/B test时,遇到这种有funnel的情况,是应该focus在表层metric还是把下游的metric一起考虑作为success metric?
  • CTR = # of users clicked / # of users searched
  • Add to cart rate = # users added product to cart / # of users clicked
  • Purchase rate = # users bought product / # of users added product to cart
. Waral dи,
3. Funnel metrics的sample size问题.1point3acres
  • 实验开始前算了需要的sample size,比如需要1000 users能达到statistical significance。上面提到的# of users searched就需要target起初计算的sample size,但是下游的metrics计算p-value时,n是不是就变成了# of users clicked, # of users added product to cart?这些metric都会比1000小很多,还能否在同一个实验中直接用小于1000的n计算p-value?还是说需要实验继续跑,直到下游metrics的n都达到sample size 1000才可以?. .и

4. 实验过程中的bug问题:如果test跑了30天,但其中某天网站出了bug影响到所有用户,导致group A/B的各种转化都趋近于0。那分析的时候是应该把这天的数据filter掉吗?如果对group A/B的影响是一样的,是不是可以保留?应该不会影响实验结果?Sample size是否也应该减去这两天的user数量?

任何想法分享都有帮助,欢迎交流讨论

上一篇:[紧急求助]狗家Early Career过了没headcount卡在TM之前,另一个狗家L4给面试面否
下一篇:Point72最后一轮和HR聊些啥
您需要登录后才可以回帖 登录 | 注册账号
隐私提醒:
  • ☑ 禁止发布广告,拉群,贴个人联系方式:找人请去🔗同学同事飞友,拉群请去🔗拉群结伴,广告请去🔗跳蚤市场,和 🔗租房广告|找室友
  • ☑ 论坛内容在发帖 30 分钟内可以编辑,过后则不能删帖。为防止被骚扰甚至人肉,不要公开留微信等联系方式,如有需求请以论坛私信方式发送。
  • ☑ 干货版块可免费使用 🔗超级匿名:面经(美国面经、中国面经、数科面经、PM面经),抖包袱(美国、中国)和录取汇报、定位选校版
  • ☑ 查阅全站 🔗各种匿名方法

本版积分规则

>
快速回复 返回顶部 返回列表