U6.03.3After filtering, state how much data remains设计
筛选后需说明剩余数据的比例
别名: 剩余比例 · 样本量显示
概念解释
筛选改变了图的样本量,但图本身不会显示这一点:一千条数据筛到剩十二条,柱形照样饱满,趋势照样"清晰"。不说明剩余比例,读者无法区分"稳定的模式"与"小样本的偶然",图表的每一个结论都在缺失关键限定的情况下被消费。
机制
样本量是读图的隐含变量:读者对图表结论的信心取决于"这个结论建立在多少数据上",而图形编码不携带这个信息——两根饱满的柱形可以是十万条也可以是八条。剩余比例显示把这个隐含变量显式化("显示 12,340 / 1,203,882 条,约 1%"),读者据此校准信心:比例骤降时先怀疑代表性,再谈趋势。它还承担异常哨兵职能——筛选条件写错(比如区间输入颠倒)时,剩余量会掉到异常小,比例显示让这类错误在一秒内暴露,而没有它,错误结论可能直接进入汇报。
边界
比例显示的粒度按受众定:分析者要看绝对数与百分比(12,340 条,1%),高层读者看百分比即可,两者都给最稳妥。聚合视图的"剩余量"有歧义——记录数、聚合桶数、汇总值各不相同,需标明口径("剩余记录 12,340 条(聚合为 87 个分桶)")。全量未筛选时无需显示比例,但显示"全量 1,203,882 条"仍有价值——它为后续筛选建立基数。极端比例(剩余不足 1%)配合警示样式,防止读者无感知地接受小样本结论。
怎么落地
- 筛选状态栏固定显示剩余量:"显示 12,340 / 1,203,882 条(1%)",绝对数与百分比并列。
- 剩余比例低于阈值(如 5%)时加视觉警示,提示代表性风险。
- 验证:请读者在完成一次深度筛选后回答"现在图上有多少数据";答不出即比例显示缺失或不显眼,调整位置与样式。