符合标准不等于实际可用
别名: 符合性不是可用性 · 清单全绿 · 任务失败
概念解释
自动检查全绿,键盘也能 Tab,对比度数字过线。阅读器用户在支付第三步仍然迷路:步骤名听起来都叫「按钮」,错误被读成一串数字,成功态没有出现在朗读流里。符合标准(conformance)回答的是「抽样到的准则有没有被满足」;可用性回答的是「这个人在这个情境里能不能完成这件事」。两份答卷用的不是同一套题目。
工效过程走完了也可能不可用——请来的「用户」是两名实习生,任务是打开首页而不是下单。清单和档案都不是路考。
机制
结果型准则是必要条件和抽样。对比度、名称、键盘到达,少任何一条都可能让任务直接失败,所以它们值得写成可重复的检查。但它们不建模整条任务:不测步骤是否过多、用语是否对得上这个人的模型、动态更新有没有进朗读、第三方控件抽样时是否碰巧没抽到。工具分数把「没发现已知模式的失败」显示成通过,不等于「发现了成功」。
过程标准同样有空心化路径:活动名称都在,参与者不是目标用户,评价任务不是关键路径,发现没有回流。档案能证明「做过形状正确的事」,证明不了「这件事对将要使用的人成立」。ISO 9241-11 把可用性定义在情境中的有效、效率与满意;无论是 WCAG 符合性还是过程符合性,默认都不输出这三项。
第二层是评价对象错位。符合性的对象是产品(或抽样页)相对一份准则表;可用性的对象是「某类人 × 某类任务 × 某类环境」。对象不同,通过不能传递。
怎么研究
在已宣称符合的版本上做关键路径的辅助技术任务测试:同一条下单/预约/提交,使用用户自己的设备和阅读器(或开关、语音),记录能否完成、在哪一步停、停的原因是准则未覆盖还是准则覆盖了但组合起来仍不可用。
自变量:是否已有符合性报告、任务是否为真实关键路径、参与者是否为该任务的目标用户并使用自有 AT。 因变量:任务完成率、完成时间、在符合性已勾选的步骤上仍然失败的次数与原因编码。
专家走查和自动化作为符合性的输入有用;它们替代不了任务成功率。样本量可以很小,结论要写成「这些用户在这些任务上失败」,不要写成「因此符合性无效」——符合性仍然可能是必要的,只是不够。
边界
高风险、窄任务、用户受过训练的专业系统,符合一份行业清单有时已经非常接近「可用」,因为任务和用户已经被标准的情境假定写死了。相反,消费级产品的用户和情境发散,符合性与可用性的缝最大。符合性抽样如果碰巧覆盖了全部关键路径并且含 AT 用户任务,缝会缩小——那是评价设计变了,不是符合性自动变成了可用。法律要的往往是符合性证据;那不阻止产品在符合性之外另设任务成功率门槛。
怎么落地
- 符合性报告通过之后,另列关键任务的 AT 用户通过标准(完成、不需求助),不过线不算交付。
- 失败要编码:是某条准则其实没满足,还是准则都满足但流程、用词、动态更新让任务仍断。后一类不要退回给「再跑一遍自动检查」。
- 过程评价的参与者和任务必须与交付对象重合;用实习生打开首页,不得写入可用性结论。
- 验证:请至少两名使用自有辅助技术的人走完结账或等价关键路径。自动检查全绿但任务走不完,把「符合」和「可用」分成两行写进发布记录,禁止用一行分数同时代表两者。