多样应发生在用户关心的维度上,跨品类的多样解决不了观点的单一
别名: 相关维多样 · 假多样 · viewpoint diversity
概念解释
首页上有美食、体育、财经,类目熵很高,三条新闻却来自同一立场、同一家媒体。对来看公共事务的人,这不叫多样。发生在有关维度上的多样(diversity on relevant dimensions)指:铺开必须落在用户此行在意的那一轴——观点、作者、风格、难度——而不是拿一个好做的轴(品类、时长、语言)来交差。
跨品类的拼盘是最便宜的多样指标。它常常对不上正在收窄的那一维。
机制
仪表盘喜欢可自动标注的轴:叶子类目、时长桶、语言。观点、叙事框架、创作者网络要贵得多,于是优化器在便宜轴上把覆盖做满,贵的轴保持单点。用户的任务定义了「有关」:找菜谱时,餐种是有关维、政治立场无关;读新闻时反过来。用无关维的高覆盖去安慰有关维的单点,是指标替代。
Pariser 讲的气泡,核心伤害在观点与议题被关进同温层,不在「有没有穿插一条体育」。体育穿插甚至会让覆盖报表变好看,同时把真正的收窄藏起来。维度选错,结构化方法也会很勤奋地铺错方向。
怎么研究
先引出任务:用户此行要比较的是什么。再在该维与一个无关维上分别加配额,测:任务相关的感知多样、任务表现(能否看到对立观点、不同作者)、无关维覆盖、点击。自变量:配额加在哪一维、用户如何描述自己在意的轴。因变量:有关维上的真实铺开、把无关维拼盘判成「已经很丰富」的误判。
不要用类目熵当新闻场景的成功。那正是假多样的定义。
边界
休闲流览、没有单一任务时,有关维不稳定,需要可切换的轴(「换作者」「换风格」)而不是一次钉死。儿童内容的有关维可能是难度和主题安全,不是观点。目录在有关维上本身就只有一个值(单一作者播客),多样做不出来,应改用相关推荐之外的入口。这条选维,不讨论随机洗牌,也不讨论必须把多样写成目标。
怎么落地
- 为每条主要表面写下一句「此行用户在比较什么」,配额只加在这句话里的轴。首页若承担多种任务,分轨,不要用一条类目熵应付全部。
- 报表按有关维拆开:新闻表面报来源与立场,不要只报一级类目。
- 验证:在观点已经收窄的用户上,只加跨品类配额。若类目熵上升而观点熵不动,这就是假多样。把配额改到来源或立场再看观点熵。