L1.08.5show confidence only if it changes the next act设计研究

置信度只有在用户能据此改变下一步动作时才值得显示

别名: 可行动的置信 · 显示的门槛 · actionable confidence

概念解释

屏幕上的每一个数都在花注意力。置信度若不能让下一步变成另一件事——核或不核、发或不发、选 A 还是选 B——它就是噪声,还带着测量的伪装。可行动才显示(show confidence only if it changes the next act)是显示的准入:先写下它将翻转的动作,写不出来就不要画。

这条是显示政策,不是又一种编码。

机制

透明度的默认压力是「有就给」。内部刚好有一个浮点,于是它出现在每一条消息旁。人的决策早被别的东西决定了(必须发出去、只有一个候选、反正要自己改),分数没有支点,却仍被读成保证或威胁。无法行动的信息不是中性的:它占用核对配额,并制造「我已经根据科学数字做了决定」的错觉。

动作支点必须是界面允许的。告诉人「低把握时请小心」而界面没有「小心」这个动作(没有复核队列、不能暂存、不能换人),支点是空的。空支点上的分数只剩情绪效果。

怎么研究

先列出产品里真实存在的下一步(发、存草稿、指派、换候选)。再做有无分数的 A/B,看这些动作的分布变不变。不变,分数在该场景无资格显示。自变量:动作是否在界面上可点、分数是否跨过该动作的阈值。因变量:动作翻转、注视时间、事后「这个数帮了什么」。

自报「有帮助」而动作分布不变,是典型的假阳性。主终点是动作。

边界

研究、调试、审计界面的下一步就是「看分布」,分数有支点。消费级一次生成、动作集合为空或全强制时,没有支点。同一分数在预览和在发送确认里资格不同:预览里也许只影响编辑,发送确认里才影响外发。资格要按表面分别评估。这条假定前面那些误导机制成立,它给的是「那还显不显示」的闸。

怎么落地

  • 写一张表:每个表面、每个分数,对应哪一个可点的动作、阈值是什么。表空则该表面不显示分数。
  • 低把握必须接通一个真动作:暂存、指派、强制核对清单。接不通就不要显示低,以免只吓人。
  • 高把握接通的动作不得是「跳过所有核对」,除非该表面的后果允许。
  • 验证:藏掉分数,看动作分布。与显示时无差异,把分数从该表面拿掉。有差异,再检查差异是不是你们写下的那个动作——若人只是更焦虑地点了同一按钮,仍算无资格。

延伸

  • 同组L1.08.1 置信度是模型的自我报告,用户没有独立核验它的手段 · L1.08.2 百分数会被读成频率承诺,而模型给出的数值多数未经校准 · L1.08.3 分档呈现比连续数值更不易被过度解读,代价是掩盖档内差异 · L1.08.4 对同一批输出统一显示高置信等于没有提供区分度
  • 相邻L1.03 不确定性的可视化 · L5.05 透明度的适度原则 · L1.04 置信度呈现
  • 站内检索actionable confidence · display threshold · uncertainty that changes acts

同组卡片

快捷操作

分享

分享当前页面

ios_share

https://hci.top/zh/handbook/L1.08.5