当前位置: 首页 > news >正文

数据分析相关面试题-A/B 测试 统计学部分

数据分析相关面试题汇总

目录

A/B 测试

什么是 A/B 测试?

为什么要做 A/B 测试?

A/B 测试核心指标怎么选?

完整 A/B 测试流程是什么?

统计学

原假设 H0 和备择假设 H1 是什么?

p 值是什么?

显著性水平 α 和功效 Power

一类错误 & 二类错误

什么是置信区间?

中心极限定理 CLT

不同指标对应什么检验?

样本量由什么决定?

实验没到样本量能停吗?

为什么必须随机分流?

什么是辛普森悖论?

peeking 问题(多次偷看结果)

实验前要检查什么?

显著就一定上线吗?


A/B 测试

什么是 A/B 测试?

将用户随机分成两组

  • A 组:对照组(原有版本)
  • B 组:实验组(新策略 / 新功能)通过统计假设检验判断指标差异是否显著,从而决定是否上线新版本。

为什么要做 A/B 测试?

  • 避免凭感觉决策
  • 量化新策略真实效果
  • 降低上线风险
  • 用数据证明 “有效”

A/B 测试核心指标怎么选?

  • 核心:转化率、点击率、留存、人均时长、收入
  • 辅助:用户结构、设备分布、地域分布原则:少而精,优先业务北极星指标

完整 A/B 测试流程是什么?

  1. 明确实验目的核心指标
  2. 计算所需样本量 & 实验天数
  3. 随机分流,保证两组用户同质
  4. 上线实验,埋点收集数据
  5. 数据清洗,检查分流均匀性
  6. 假设检验(t 检验 / 卡方)
  7. 根据p 值、置信区间判断是否显著
  8. 给出结论:上线 / 不上线 / 延长实验

统计学

原假设 H0 和备择假设 H1 是什么?

  • H0:两组无差异
  • H1:两组有差异只有拒绝 H0,才能说 B 版本更好。

p 值是什么?

在原假设成立(两组无差异)的情况下,观察到当前差异或更极端结果的概率。

  • p < 0.05 → 差异显著,认为策略有效
  • p > 0.05 → 差异不显著,不能认为有效

显著性水平 α 和功效 Power

  • α(一类错误):假阳性,没效果说有效果,常用0.05
  • Power = 1−β:真有效果能检测出来的概率,常用0.8

一类错误 & 二类错误

  • 一类(α):误判有效(假阳性)
  • 二类(β):漏判有效(假阴性)

什么是置信区间?

有 95% 把握认为真实提升幅度落在这个区间内。

中心极限定理 CLT

样本量足够大时,样本均值近似服从正态分布,因此可以用 t 检验。

不同指标对应什么检验?

  • 转化率 / 点击率(0/1 数据)→ 卡方检验 / 双比例 z 检验
  • 时长、分数、金额(连续值)→ 独立样本 t 检验
  • 数据不正态、异常值多→ Mann-Whitney U 检验(非参数)

样本量由什么决定?

  1. 基线转化率
  2. 最小可检测提升 MDE
  3. 显著性水平 α=0.05
  4. 统计功效 Power=0.8

期望提升越小,需要样本量越大。

实验没到样本量能停吗?

不能。样本不足 → 检验功效低 → 容易得出错误不显著结论。

为什么必须随机分流?

保证两组用户性别、年龄、活跃度、设备等分布一致,排除干扰变量。

什么是辛普森悖论?

整体看 B 更好,按维度拆分后 A 更好。原因:用户结构分布不均。避免:随机分流 + 分层分析 + 检查组间一致性。

peeking 问题(多次偷看结果)

频繁看结果会提高一类错误,导致假显著。解决:

  • 固定实验周期
  • 不中途停止
  • 使用多重检验校正

实验前要检查什么?

  • 分流是否均匀(用户结构一致)
  • 埋点是否正常
  • 有无污染、交叉影响
  • 有无系统波动(活动、节假日)

显著就一定上线吗?

不一定。还要看:

  • 提升幅度是否业务显著
  • 有无负向指标
  • 实现成本、风险
  • 长期影响
http://www.cnnetsun.cn/news/1615115.html

相关文章:

  • 告别纯Verilog手搓!用Vivado HLS快速搭建你的第一个CNN加速器(ZYNQ平台实战)
  • TCC性能瓶颈到底卡在哪?:用Arthas+Metrics精准定位4大隐性耗时源并实测压降67%
  • IDEA maven项目添加本地jar包
  • 5步重生计划:让老Mac重获新生的开源工具全流程指南
  • Keil多目标工程管理与嵌入式开发实践
  • Function Call学习
  • ssm+java2026年毕设停车场管理【源码+论文】
  • BVH构建优化:四种分割算法在光线追踪中的性能对比
  • Python之Flask开发框架(第二篇) — 模板、表单与数据库
  • 别再到处找模型了!手把手教你用Xinference+Docker本地部署私有LLaMA模型(附完整目录结构)
  • 利用Opencv+Mediapipe实现实时头部姿态追踪与可视化
  • 车载Android Auto兼容性开发全链路(车规级Java SDK集成手册)
  • FeignClient调用接口参数为null?可能是这个阿里规范在作怪
  • ESP32 BLE实战:5分钟搞定自定义GATT服务(附完整代码)
  • 多设备协同登录解决方案:WeChatPad无缝登录技术全解析
  • VBA循环到底用For、Do While还是Do Until?看完这篇别再傻傻分不清
  • OpenCore Legacy Patcher技术突破:深度解构非官方macOS升级的终极方案
  • 开发慢、运维难?JVS 低代码重塑企业数字化交付效率
  • CodecWSN:面向WSN的8字节二进制编解码协议解析
  • 2026年山东潍坊美都西瓜采购指南:如何挑选靠谱代办?
  • 为什么你的密码总被破解?聊聊哈希算法在密码存储中的那些坑
  • 百度网盘解析工具:突破下载限制的高效解决方案与极速体验
  • 解码汽车ECU的“健康档案”:剖析吉利Basetech五大运行周期计数器(OCC)的协同诊断逻辑
  • 5分钟搞懂卷积:从数学公式到PyTorch实战(附代码)
  • 基于JAVA实现modbus rtu通信(二):数据类型转换与读写实战
  • 保姆级教程:在Qt 5.14.2的QWidget里用PCL 1.8.1显示并实时调色点云(附完整.pro配置)
  • DS4Windows手柄适配工具全解析:从安装到高级配置的完美指南
  • 告别docker.io!Podman切换国内镜像源提升10倍拉取速度
  • 双向全桥隔离DC-DC变换器(DAB)的调制与控制优化策略
  • 复值神经网络(ComplexNN):从理论到开源实现,解锁信号处理与LLM新潜力