追问过多会把交互变成问卷,抵消自然语言原本的效率优势
别名: 澄清变问卷 · 追问疲劳 · slot-filling in disguise
概念解释
用户说「帮我回这封信」。系统回:「请问:1. 接受还是拒绝?2. 语气正式还是轻松?3. 要不要提下次时间?4. 用中文还是英文?」四问之后,人还不如自己打开邮件点回复。自然语言的效率来自一次说出意图、省略已显然的槽;把省略重新问回来,交互就退化成伪装成对话的填槽问卷(over-clarification as questionnaire)。优势被自己抵消了。
问卷感不取决于问题写得是否礼貌,而取决于人必须先答完系统的清单,才能看到任何结果。
机制
对话系统常按槽位完整度来决定能不能行动:缺一个槽就问一个。槽位表是设计者的任务模型,不是用户此刻的决策。用户已经用一句话声明了他们愿意提供的信息量;把其余槽全问完,是在强迫他们按系统的完整度工作。每一问还有切换成本:人要从写意图的模式切到答选择题的模式,问得越多,切得越碎。
过问还会改变归因。人开始觉得「这个东西不会读人话,只会做表单」,于是改用最短的选项编号来回答,不再给出丰富约束。数据上槽填得更满,语言通道被用户自己关了。
怎么研究
同一意图用三种界面:一次给结果、最多一问、按槽位表问完。因变量:到第一份可用结果的时间、主动放弃率、后续是否还用整句、还是改成「选 2」。把追问次数和问卷感评分画在一起,找问卷感陡增的那一问——那就是这条产品的过问点,不是理论上的槽位数。
实验室若禁止「我自己回邮件」,会低估放弃。必须允许逃到外部工具,逃逸本身就是主终点之一。
边界
监管或安全要求的必问项(是否发给外部、是否涉及个人数据)不是问卷问题,应单独、一次性问清,并说明为什么这轮不能省。专业软件里用户期待被问全(报税、开处方),问卷是工作本身。语音里每问一轮很贵,过问的伤害比屏幕上更大;屏幕上把多槽收成一张短表,有时比连环追问更不像问卷。
怎么落地
- 默认最多为真正分叉的那一维问一次,其余用假设填上并开工。禁止「先把表问完再生成」的流程出现在以自然语言为卖点的入口。
- 若必须收多个槽,改成一张可跳过字段的短表,不要拆成四轮对话。跳过的字段用假设,并允许事后改。
- 连续两轮都被人用编号回答时,视为语言通道已关,停止再问新槽,改为给一个可改的草稿。
- 验证:用「回这封信」做任务,统计到第一份草稿前的系统问句数。超过一句且草稿还没出现,记问卷事故。再看用户回答是整句还是编号——编号占比升高,说明人已经把产品当表单用,自然语言优势在行为上消失。