A8.19.4Short usability tests miss this problem研究设计
短时可用性测试无法暴露该问题
别名: 测试时长盲区 · prolonged-use fatigue blind spot
概念解释
常规可用性测试单个任务通常只有几十秒到几分钟,这个时长窗口本身就小于举臂类疲劳开始显现所需的时间量级,导致测试报告一切正常,而实际部署后长时间使用时用户才开始抱怨手臂酸痛——这是一种系统性的测试方法盲区,不是测试执行得不够仔细的问题。
机制
可用性测试的任务设计通常以完成率和任务时间为核心指标,这类指标只要求被试完成一次或几次动作,累积负荷还来不及跨过前面提到的耐受阈值,测试就已经结束。测试之间的间歇、被试对新奇任务的兴奋度,以及被试知道自己被观察而倾向于忍耐不适,都进一步压低了在测试中报告不适的概率。结果是这类测试系统性地对举臂类交互给出偏乐观的可用性判断,而不是随机误差。
怎么研究
要暴露这个问题,需要把任务时长或重复次数刻意延长到超过预期的实际使用场景(比如让被试连续操作五到十分钟而不是走一次流程),并在过程中插入固定间隔的疲劳评分或肌电记录,而不是只在任务结束时问一次总体感受;也可以采用日志研究或现场观察,采集真实使用场景下的持续操作时长分布,反推测试该覆盖的时长范围。
边界
这个盲区只出现在测试时长明显短于实际连续使用时长的场景;如果目标交互本身就是偶发的、单次几秒钟的操作(比如一次性确认手势),标准短时测试并不存在这个问题,延长测试反而没有意义。
怎么落地
- 在测试计划阶段,先估计目标交互在真实场景下的典型连续使用时长,把测试任务的持续时间或重复次数设到不低于这个量级,而不是套用通用的几分钟任务模板。
- 在测试过程中按固定时间间隔(如每 15–30 秒)插入一次简短疲劳评分,形成随时间变化的曲线,而不是只在结束时问一次。
- 验证办法:对比同一交互在"标准短任务"和"延长至真实使用时长"两种测试条件下的疲劳评分曲线与用户是否主动要求中止,如果延长条件下出现短任务测不到的中止请求或评分陡升,说明原测试方案存在盲区,需要把延长版本纳入正式评估流程。