跨会话记忆会把一次性偏好固化成长期设定
别名: 一次性偏好固化 · 记忆把玩笑写进档案 · standing setting from a probe
概念解释
用户在某次邮件里说「这次用刻薄一点的口气试试」。跨会话记忆把「刻薄」写进档案。之后几周的每封信默认都刻薄,包括给客户的正式信。一次试探被当成长期设定,这是一次性偏好固化(one-shot preference solidification)。固化的不是「系统会记住」,是「单次、带试探语气的指令被提升成了人设」。
会话内记住刻薄、会话结束丢掉,是连续。跨会话记住刻薄、不再问还要不要,是把草稿写进户口本。
机制
记忆写入缺少「时效」字段。抽取偏好的管道看到「用刻薄口气」,不知道「试试」「这次」在语用上标了临时。写档案的目标函数往往是「多记住一点以便下回省事」,于是召回率优先于时效精度。读档案的一侧把取出的条目当成始终有效的系统提示,不再经过「这还是现在的我吗」的确认。
试探、反话、角色扮演是高危来源。它们在当轮是合法的语言游戏,在档案里变成身份。人几天后回来,面对的是一个自己不记得签过的人设,会把产品判断成「它自己变了」,而不是「我某次随口说的话被升级了」。
怎么研究
在实验会话里植入带时效标记的指令(「这次」「先」「试试」)和不带标记的指令,隔开一段时间或强制新开会话后再观察默认行为。因变量:临时指令是否仍主导、用户是否记得自己说过、发现固化后的撤销代价。自变量:抽取是否过滤时效用语、写入前是否确认、记忆条目是否展示时效。
间隔很重要。当场问「它会不会一直这样」测到的是推断,不是固化。固化发生在档案被另一会话读出的时候,实验必须跨会话,不能只在同一线程里等几轮。
边界
用户明确说「以后都这样」「记住这个」时,固化是被请求的,应当写入并可见。纯工具型、声明不跨会话记忆的产品没有这条问题。把「常用收件人」「默认语言」这类稳定事实写入,和把语气、立场、玩笑写入,风险不在一个数量级;事实类可以默认长期,语用类必须默认本次。医疗、法律、财务场景里错误固化的危害更大,写入门槛应高于娱乐聊天。
怎么落地
- 抽取偏好时把时效用语(这次、先、试试、扮演)标成「仅本会话」,默认不进跨会话档案。
- 任何要跨会话生效的条目,在写入前用一句话确认范围:「以后的邮件都用这个口气?」否定则只留在本会话。
- 档案里的语气、立场类条目必须能被看到、能被关掉、并标明来自哪一次对话。不允许只有「关闭全部记忆」一个开关。
- 验证:在会话 A 说「这次刻薄一点」,关闭后开会话 B 写一封给客户的信。B 的默认不得刻薄。若刻薄了,查档案里是否出现了无时效的语气条目——出现即固化事故。再加上「以后都这样」的对照句,B 才应切换,且档案里该条可见。
延伸
- 同组:L2.14.1 上下文提高连续性,同时也让早前的误解持续影响后续输出 · L2.14.2 用户通常不知道系统实际记住了什么,需要可查看的上下文视图 · L2.14.3 需要显式的清除动作,靠新开会话来清除属于隐式约定 · L2.14.5 上下文超长被截断时,用户看到的是没有解释的能力退化
- 相邻:L6.09 反馈回路与偏好固化 · L6.06 隐性偏好推断及其边界 · L5.12 拟人化的期望膨胀风险
- 站内检索:
one-shot preference solidification·cross-session memory·temporary instruction stored as persona