L6.07.2post-hoc recommendation hallucination设计研究

理由必须来自真实的推荐依据,事后编造的理由是另一种幻觉

别名: 事后理由 · 编造的解释 · rationalised why

概念解释

排序器先打完分,再另开一个语言模型或文案模板,根据封面和标题编一句听起来像那么回事的「因为」。这句「因为」没有进入过打分。事后推荐幻觉(post-hoc recommendation hallucination)指:理由是结果出来之后生成的故事,与依据脱节,形式上却像解释。

忠实是「这句话指向真实贡献」。这里多一刀:连生成时序都是先有结果后有故事——幻觉不只发生在聊天模型里,也发生在推荐的理由栏。

机制

事后生成优化的是像不像人话,不是过不过打分日志。于是它可以引用从未用过的特征、编造用户没做过的行为、把广告位说成口味。用户用这套故事去模拟系统,下一步预测必然偏。更糟的是故事往往自洽,比真实但难听的依据(配额、投放)更容易被相信。

生成管道与排序管道断开,还让反驳落空:用户否定故事里的那条「因为」,真正打分特征纹丝不动。可反驳性建立在理由与依据同一条绳子上;事后编造把绳子剪开,只留下一段装饰。

怎么研究

对照三种理由源:从排序日志抽取的贡献、模板填真实特征、对同一条目让生成模型只看元数据写「因为」。编码:是否提及真实贡献、是否提及未使用特征、是否捏造行为。因变量:用户能否据此预测下一条、否定理由后排序是否变化、把理由判成「编的」的比例。

不要用「好不好读」当终点。事后文案几乎总会更好读。要报的是与日志的对齐,以及否定文案能否改变对待。忠实度研究问内容是否为真;这里问生产时序是不是先果后因。

边界

没有可用日志、只能给编辑理由的人工榜单,本来就不是模型解释,应标明「编辑推荐」,不要伪装成个人依据。特征不能公开时,允许说「还有未列出的因素」,那是承认缺口,不是编一个替代故事。这条针对事后生成管道,不处理语义真空的套话,也不处理理由当作推销。

怎么落地

  • 理由只允许从本次打分用过的特征或近邻生成。生成模型若在用,输入必须是那份特征清单,禁止只喂标题和封面。
  • 抽检:每周把理由与打分日志对一下,命中未使用特征或捏造行为的句子下线。
  • 验证:否定界面上的那句「因为」,排序应发生变化。若故事被否定而位次不动,这就是事后幻觉。

延伸

  • 同组L6.07.1 理由的作用是帮用户判断该结果是否值得点开,而非说服其点开 · L6.07.3 理由暴露了数据来源,可能让用户意识到被追踪从而产生反感 · L6.07.4 理由使推荐可被反驳,用户能据此纠正错误的画像 · L6.07.5 所有条目使用同一句式的理由,等于没有提供任何信息
  • 相邻L6.01 推荐理由 · L3.03 幻觉与事实核对负担 · L5.08 反事实解释
  • 站内检索post-hoc recommendation hallucination · rationalised why · faithful explanation pipeline

同组卡片

快捷操作

分享

分享当前页面

ios_share

https://hci.top/zh/handbook/L6.07.2