A9.07.3Retrospective workload rating and the peak-end effect研究设计
任务结束后的回顾性评分容易受峰值与结束时刻的体验主导,偏离全程平均
别名: 回顾性负荷评分 · 峰值-结尾效应 · 事后总评分
概念解释
事后回顾性评分(retrospective rating)指任务全部结束之后才让用户对整个过程的负荷打一次总分,而不是在过程中实时采样。这类评分容易受峰值-结尾效应(peak-end effect)主导——用户报告的其实主要是过程中负荷最高的那个瞬间和刚结束那一刻的感受,而不是整个过程的平均水平。
机制
人在回忆一段体验时,靠的不是对全程逐秒积分求平均,而是从记忆里抓取几个最突出的片段来重建整体印象,负荷体验的记忆同样遵循这个规律:峰值时刻的强烈感受和最后阶段的感受在记忆中权重被放大,中间平稳但持续时间更长的部分反而被淡化甚至遗忘。这意味着两段全程平均负荷相近的任务,只要峰值出现的位置或收尾的方式不同,回顾性评分就可能给出差异悬殊的结果。
怎么研究
检验这类偏差的常见做法是同时采集任务进行中的实时评分序列与任务结束后的一次性回顾评分,再比较回顾分数分别与序列均值、峰值、终值的相关强弱,通常发现回顾分数与峰值和终值的相关明显高于与全程均值的相关。方法论提醒是,如果研究或测试的目的是了解"过程中究竟哪里最费力",只采集事后总评分会丢失这个信息,必须配合过程中的实时采样才能定位。
边界
当任务本身很短、过程波动很小时,峰值-结尾效应的影响有限,回顾评分和真实全程负荷相差不大。当任务较长、存在明显的负荷起伏(比如先易后难或先难后易)时,单纯依赖事后总评分来判断"这段体验整体上是否吃力"会系统性地被峰值或结尾主导,不能代表典型或平均的操作状态。
怎么落地
- 评估一个较长流程(比如多步骤的复杂表单或引导流程)的整体负荷时,不要只在流程走完后问一次"整体感觉如何";在关键节点插入简短的实时评分。
- 刻意检查流程的最后一步是否被设计成负荷骤增的收尾(比如结尾要求二次确认大量信息),因为糟糕的收尾会不成比例地拉低用户对整个流程的回顾评价。
- 验证办法:对比实时评分曲线与事后总评分,如果两者严重不一致,优先按实时曲线定位真正需要优化的阶段,而不是被事后总评分误导去改错地方。