局部重生成与整体重生成的成本差异应让用户看得见
别名: 局部与全文代价 · 重生成成本可见 · regen cost transparency
概念解释
「改这一句」和「整篇重写」在模型侧的耗时、计费、失败面都不同:局部通常更短、更便宜、动到的范围更小。若两个动作在界面上长成同一颗「重新生成」按钮,用户无法按成本来选,只会用自己以为更安全的那一种——常常是整篇重来,因为局部看起来像在碰运气。成本差必须可见(visible cost of local vs full regen),否则局部入口即使存在,也不会被当成真正的另一档操作。
可见的是用户决策用得上的差:要等多久、会动哪一块、这次大概消耗什么额度。不是把 GPU 利用率摊在屏幕上。
机制
选择依赖可比较的属性。两种重生成若共享图标、文案和等待动画,属性被抹平,决策退化成习惯。习惯偏向整体,因为整体的心智模型简单(「再抽一次」),局部还要先指定范围。当局部其实更省、整体其实更贵时,不可见的差价会把流量全部赶去贵的那一侧,局部功能在数据上显得没人要,于是被撤掉——这是界面制造的假需求信号。
等待时间本身也是成本。局部若仍走整篇推理却只把结果贴回一句,用户感到的时延和整体一样,会判定「所谓局部并不局部」。可见性包含诚实的时延,不包含把同样的等待画成不同的动画。
怎么研究
同一任务提供两种入口,操纵成本信息:不显示差 / 显示预估时长 / 显示将被动到的范围 / 显示额度差。因变量:局部入口的选用率、任务完成时间、不必要的全文重写次数。再测一次「伪局部」(后端仍全文推理)对选用率的伤害——若时延与整体相同,选用率应回到接近零。
不要只问「你觉得局部更便宜吗」。支付意愿和实际点击经常分开;主终点是在真实时延和真实范围下的选择。
边界
两个动作在后端成本接近时(短文本、必须重算全文上下文),强调差价会制造虚假对比,应合并成一个动作并如实说明。包月无限额度的产品里,钱不再是决策变量,范围和时延仍是。无障碍场景里,成本差要用文本说,不能只靠进度条颜色。离线或本地模型若时延差极小,可见性应转向「会改哪些句子」,而不是秒数。
怎么落地
- 把局部和整体做成两个可区分的动作,并在动作旁写清将等待的量级和将覆盖的范围(「约改 2 句 · 数秒」相对「全文重写 · 更久」)。
- 范围在发送前高亮。若后端做不到真正的局部推理,不要用局部的名字;改口为「重写全文并试图只改这里」,避免假差价。
- 额度或配额存在时,用同一单位标出两种动作的消耗,让人能比较,而不是只在用尽时才弹出。
- 验证:在可真正局部推理的任务上,拿掉成本说明一周,再打开成本说明一周,比较局部入口占比。说明打开后占比不上,检查是不是时延其实没差——把两次操作的实测耗时打在按钮旁,差小于用户刚可分辨的间隔就不要再宣传「更快」。