Q3.04.2A/B tests select among existing variants设计研究

只能比较已有方案,不产生新方案

别名: A/B 不生成方案 · 方案选择而非探索 · 候选集限制

概念解释

A/B 测试是在已经实现的候选之间做选择:两版(或多版)代码、文案或布局被放进随机分流,比较哪一版在指定指标上更好。它不产生第三种尚未做出的结构,也不能把“更好”翻译成“还缺什么”。实验结束时得到的是候选集上的排序,不是需求发现。把测试排期当成创新流程,会让团队只发明测得动的小改动,因为没被做成变体的想法从未进入比较。

机制

随机分流需要每个臂都是可交付的产品状态,否则用户分过去会撞上未完成的路径。这个约束把搜索空间锁在工程已经付清成本的点上。生成新方案依赖对失败原因、未满足目标和替代做法的观察,那些材料来自访谈、现场和探索性原型,不会从指标差里长出来。指标差只回答“在已有点里哪一个更高”。候选集越同质,实验越“干净”,同时越不可能冒出结构不同的选项。于是方法越用越勤,方案空间越收越窄。

怎么研究

把一段时间里上线的实验按“候选之间的结构距离”编码:文案级、组件级、流程级、任务模型级。统计各档的数量和胜出率。若几乎全是文案级,说明生成步骤被跳过,而不是实验方法失败。对胜出实验回溯其想法来源;若来源全是上一轮胜出的微调,记录搜索是否在收缩。对照:同一问题先做小样本生成研究再进入 A/B,与直接抛两个现成稿,比较最终上线方案是否仍停在原候选集内。

边界

当问题已经收束到两个可实现、且结构完整的方案(例如两种合法的默认值),选择就是全部任务,A/B 不需要再生成。探索性多臂若把明显未完成的概念硬塞进流量,伤害的是用户,不是对“不生成”这一限制的克服。专家评审或设计工坊产生的方案在进入分流之前仍须做成可运行臂;未实现的草图不能假装已经在实验里被比较过。

怎么落地

  • 开实验单时写明候选清单和“本轮不在清单里的问题”;后者走生成研究,不占用实验位。
  • 禁止用“先随便做两个版本测”代替问题定义;没有独立于两稿的成功标准,就不要分流。
  • 每个季度检查实验组合:若没有流程级以上的候选,先停测,补观察和原型。
  • 胜出方案归档时附上未被测试的替代结构,避免下轮只从胜出版再分叉。

延伸

  • 同组Q3.04.1 随机分流保证可因果推断 · Q3.04.3 局部最优会掩盖结构性问题 · Q3.04.4 短期指标提升可能带来长期损害
  • 相邻Q2.13 共创工作坊 · Q1.01 研究问题的提法
  • 站内检索variant set · generative versus evaluative · A/B selection

同组卡片

快捷操作

分享

分享当前页面

ios_share

https://hci.top/zh/handbook/Q3.04.2