分数不定位具体问题
别名: SUS 非诊断 · 总分不能定位 · 整体分与问题清单
概念解释
SUS 总分是会话结束后的整体印象。58 分和 81 分可以比较谁更高,但不能指出是搜索、表单还是权限导致了低分。十道题本身也是全局评价(复杂、一致、愿意频繁使用),不是针对屏幕或步骤的问题清单。把总分当诊断,会把“感觉不好用”误写成已经定位的缺陷;真正的定位仍要靠任务行为、错误类型和参与者指出的具体位置。
机制
每道题都在问整次使用,回答者把许多时刻压成一个数字。低分的生成路径有很多:关键任务失败、全程轻微摩擦、某句文案引发不信任、或对品牌的既有态度。合成步骤再把十个全局数字加总,路径信息进一步消失。即便回看单题,例如“不必要的复杂”,它仍然没有坐标:复杂可以在导航、可以在术语、可以在错误恢复。量表设计目标是稳定的总体分数,这个目标与“指出哪一处”在信息上是对冲的——为了可比,它必须丢弃位置。
怎么研究
把 SUS 与任务级行为并排:完成、错误、求助、放弃点。检查低分组是否共享同一失败位置;若低分来源分散,总分只说明“有问题”,不能指导改哪一屏。单题与行为的相关通常弱且不稳定,不应把某题当作某类缺陷的代理。可用严重性分级或问题映射来承接诊断功能,SUS 只保留为会话级摘要。实验上,人为只破坏一个已知步骤,观察总分下降但单题并不指向该步骤,可演示其非诊断性。
边界
样本极小、只有一两个明显阻塞时,低分和那一两个阻塞在个案上碰巧对齐,仍不能把对齐推广成“SUS 能定位”。产品只有一个核心任务时,总分更接近对该任务的评价,但仍然没有步骤坐标。开放评论框若与 SUS 一起收集,诊断来自评论,不是来自分数。把十分拆成“可用性 / 可学习性”之类子量表超出原工具的设计承诺,也不能因此获得定位能力。
怎么落地
- 报告模板规定:SUS 只出现在“整体感知”栏;“改什么”栏必须引用任务失败、错误或录像位置。
- 低分触发的行动是去查行为材料,而不是开题讨论第几道 SUS 题。
- 禁止根据单题增减功能(例如因“我会频繁使用”低而加推送)。
- 验收改版时,分数上升且关键失败消失才算定位被验证;只升分、失败点仍在,说明诊断从未发生。