L3.13.4edits are richer implicit feedback than ratings设计研究
用户的编辑行为是比显式评分信息量更大的隐式反馈
别名: 编辑即反馈 · 隐式反馈 · edit as preference
概念解释
没有点踩。人把第三句的数字改掉,把第二段删了,把结尾换成自己的三行。这些动作带位置、带替换后的内容、还覆盖了不愿意点控件的沉默用户。编辑即反馈(edits as implicit feedback)比显式评分信息量大:它同时给出「哪」、「不好在哪变成了什么」,而且不要求人专门去评。
自选择让评分偏向极端。编辑发生在将就之前的那一步,中间用户更常出现。
机制
修订是对照:原文跨度 → 用户认为可接受的跨度。这是一个有监督的局部差异,比一个比特的极性多出对齐。删掉的块是负例,留下的块是弱正例,插入的块是目标。位置不必再问,因为光标已经问过了。
编辑还有一个评分没有的维度:改完之后人愿意交出,说明修订后的版本通过了该用户的验收。拇指上的「赞」没有这个交付约束,可能只是情绪。
怎么研究
同一批会话,比较:只用拇指训练 / 调产品 vs. 用编辑差异(原文跨度、修订后跨度)。因变量:后续错误率、定位准确、覆盖的用户面(有多少从未点过拇指的人出现在编辑数据里)。自变量:是否排除纯格式改动、是否把「删掉重写」当成整篇负例。
必须把格式性润色和事实性替换分开。把改逗号当负反馈会污染。
边界
将就者不编辑,编辑数据仍会漏掉最懒或最无助的用户。高门槛会抑制编辑,隐式信号变少,不能反过来当成质量变好。隐私:编辑内容可能含机密,进训练前要有同意与过滤。纯查看器产品没有编辑,这条没有对象。
怎么落地
- 把保留下来的编辑差异当成一等质量信号,优先于拇指去定位和做局部改进。
- 记录跨度级前后文,而不是只记「有过编辑」。没有前后文就退化成又一个无位置极性。
- 过滤掉纯空格、大小写、明显的格式工具改动,以免淹没事实替换。
- 验证:对照拇指集和编辑集覆盖的用户。编辑集若明显更宽,且用它修过的错误类型拇指里没有,隐式反馈已经比评分更有信息。