L3.07.2comparison collapses into noise-picking设计研究
方案之间差异过小时,比较退化为在噪声中挑选
别名: 噪声挑选 · 无差别比较 · picking noise
概念解释
两个摘要并排,意思几乎一样,人选了右边那份——理由是「好像长一点」。长一点不是任务维度,是还看得见的残差。噪声挑选(noise-picking)指的是:当方案在决策维上的差低于可辨阈限,相对评价不会停,它会改去抓任何还分得开的东西:字数、标点、先看到的那一侧。比较过程还在运转,信息已经没了。
集合算不算多个方案,是可辨性作为入场条件。这里管的是比较正在发生时,阈限以下的差把评价腐蚀成抓噪声。
机制
相对判断是强制完成的。界面要了一个选择,人就会交一个选择。差别阈限以下,决策维上的信号进不了判断,残差和位置效应变成唯一输入。人仍能讲出理由,那些理由来自被放大的噪声,重测时会翻。
更糟的是信心不必下降。做出了选择、说出了理由,体验上像一次成功的比较。噪声挑选因而很难被自省发现。
怎么研究
制造成对方案:决策维差跨过阈限、刚好在阈限、远低于阈限(近重复)。并排迫选,隔一段时间重测。因变量:重测一致、理由是否落在任务维、信心。自变量:嵌入距离、人工可辨评分、是否提示「可以选一样好」。
「可以选一样好 / 无法区分」作为选项必须有。没有这个出口,所有阈限下条件都会被强迫交卷,噪声挑选被做成实验伪影。
边界
用户要的就是微调,阈限下的差是目标,挑选「稍微短一点」不是噪声。审美任务里微小差别有时就是风格。封闭答案的近重复不是噪声挑选,是假选择,应合并。屏幕阅读器把微小视觉差抹平,噪声通道更少,人可能更早说「没区别」——这是更诚实的失败。这条不处理选项多到后悔,也不处理左偏。
怎么落地
- 并排前先测决策维上的差;低于可辨,合并或重抽,不要把近重复交给比较。
- 提供「差不多 / 无法区分」作为合法结果,不要强制点一个。
- 选择理由若只能说到字数、标点、左右,把这次比较标成无效,不要记成偏好数据。
- 验证:把一对近重复并排,看有多少人仍点出一个并讲出非任务维的理由。这批选择就是噪声。再提供「无法区分」,有效选择应明显下降。