U4.01.2Group or aggregate categories设计
类别过多时应分组或聚合
别名: 类别聚合 · 分组色板
概念解释
类别数越过可辨上限(上一叶)时,正确的动作不是加色,而是减类。两条路:聚合——按业务层级上卷(几十个城市聚到几个大区,几百个 SKU 聚到品类),颜色数回到上限内,比较在大区层进行;分组——保留类别但按二级维度分包(大类一色、组内用位置或分面区分),或"重点类别各占一色 + 其余并入'其他'"的聚焦模式。选择依据是问句在哪个层级:问句在大区层,聚合是终点;问句必须到明细层,分组加交互下钻才是出路。
机制
聚合与分组都利用了层级是天然的信息压缩:业务数据几乎都有分类树(城市→省→大区,SKU→品类→事业部),上层节点数天然落在色板容量内。聚焦模式(top-N + 其他)的机制是注意力的重分配:读者实际关心的类别通常集中在头部(帕累托分布),尾部类别的独立身份很少被问句需要,统一灰色的"其他"既保住头部的高对比,又如实声明了尾部的存在与体量。颜色从"每个类别一份身份"转为"问句相关类别一份身份",编码资源与注意力对齐。
边界
聚合有语义代价:上卷会掩盖组内差异与离群(某城市暴跌被大区平均吃掉),分析型问句需要下钻通道兜底;静态报告的聚合层级要在图题声明。分组的"其他"桶有纪律:不超过总量三成("其他"比每个命名类别还大时,聚合层级选错了);桶色用中性灰,禁用可能被读作一个真实类别的彩色。类别数在上限内时不要预防性聚合——可辨就全给,聚合本身也有成本。
怎么落地
- 超限即触发决策树:问句层级允许上卷 → 聚合并声明层级;必须到明细 → 分组/分面 + 下钻;头部集中 → top-N + 灰色"其他"。
- "其他"桶规则:体量 ≤ 30%、恒用中性灰、图注列出桶内构成(或提供下钻)。
- 验证:聚合后请读者回答原问句;答得出且不追问"桶里是什么",聚合层级合格——频繁追问说明压掉了问句需要的粒度。