B5.06.2Aesthetic-Usability Effect设计研究

该效应会掩盖测试中的可用性问题

别名: 测试偏差 · 好感偏差 · 测试污染

概念解释

在可用性测试里,被试对好看界面的评价整体偏高:同样的困难,发生在精美界面上更少被报告、更少被列为「严重」,主观量表得分也更高。这意味着测试主持者若只看评分与口头抱怨,精美界面的真实问题会被系统性低估。

机制

三个来源叠加:报告意愿被态度过滤——正向态度让被试把困难解释为自己的问题而非产品的问题;批评动机下降——「界面挺好看的」心理让指正显得不合群;量表本身测的是感知而非行为——对好看产品的好感直接抬升感知易用性分。行为指标(时间、错误、放弃)受影响小得多,因此「评价上升、行为没变」正是掩盖发生的指纹。

怎么研究

方法论对策是让测试设计对效应免疫:以行为指标为主判据,主观量表仅作参考;主持人提问中性化,避免诱导总体评价;测试后追问「刚才哪一步最困难」而不是「你觉得好不好用」。对照研究可以直接量化掩盖:同一界面以精美版与素版分别测试,比较问题检出数量与严重度评级的差异。

边界

掩盖主要威胁评估结论而非行为数据本身:录屏、时间与错误计数不受好感影响,问题在于综合判断时给行为证据的权重不足。对专家被试与任务导向测试,效应减弱但不清零。小样本测试里,一两个被试的好感偏差足以翻转问题排序,这正是小样本测试需要行为判据的原因。

怎么落地

  • 测试规程固定行为判据优先:完成率、时间、错误、求助,主观分不参与问题严重度定级。
  • 报告每个问题时附行为证据(录屏时间戳、错误记录),仅有口头抱怨不下严重结论。
  • 精美原型的测试结论加注偏差说明,重要决策以素版对照或行为数据复核。

延伸

  • 同组B5.06.1 外观精良的界面被认为更好用 · B5.06.3 效应有上限,严重问题无法被外观掩盖
  • 相邻Q2 可用性测试 · Q4 测量与信度
  • 站内检索testing bias · moderated testing · severity rating

同组卡片

快捷操作

分享

分享当前页面

ios_share

https://hci.top/zh/handbook/B5.06.2