封闭式提问限制表达但可靠
别名: 封闭式提问 · 选择问句 · forced-choice prompt
概念解释
封闭式提问(closed / forced-choice prompt)把答语收进一个小集合:「是降压药还是吸入剂?」「三楼还是地下车库?」识别和意图因此变得可计算,任务完成率通常高于同一槽的开放问。代价是表达被裁:用户真正要的若是「两种都要、但吸入剂先配」,封闭集合里没有这个行事,人只能选一个近似,或拒绝回答。可靠来自约束,不是来自更聪明的理解。
机制
封闭问等于在问句里公布一份微型语法。解码可以偏向这几个词,意图标签几乎与选项一一对应,槽填充从生成变成选择。错误从「完全不知道用户在说什么」变成「听成了另一个合法选项」——后一种错仍会发生,但候选是封闭的,校验和复述都便宜。
限制发生在集合的边缘。真实答语若落在选项之间、选项之外、或需要修饰(「先吸入剂,降压药下周」),封闭问没有合法位置存放。用户会做三件事之一:硬塞进最近的选项、改口说「都不是」、或开始讲一段开放叙述。系统若把硬塞当成成功,可靠性是账面上的。集合越小越稳,能表达的世界越窄;这是识别方差和表达偏差之间的交换,不是免费的准确率。
怎么研究
同一决策做成强制选择与开放叙述两种对话,同时记识别/意图正确率、无法归入选项的比例、用户改口次数、以及事后问「你刚才真正想说的是什么」与系统采纳值的一致率。自变量:选项个数、选项是否互斥、是否提供「都不是 / 两项都要」。
关键对照是「听对了但选错了世界」:系统拿到一个合法选项,用户在回顾里否认那是自己的目标。只报封闭条件的词错误率会把这类偏差藏掉。实验室若禁止「都不是」,会高估封闭问在现场的可接受性。
边界
医疗、法律里必须让人用自己的话陈述(主诉、事发经过)时,封闭问会诱导出像真的但被选项塑形的答案,可靠性伤害的是内容效度,不是识别率。选项对用户不透明(内部代码、商品 SKU)时,封闭问并不封闭,人会退回描述。两个选项足够覆盖时,封闭问几乎没有表达损失;五个以上还带修饰需求时,损失开始大于稳定收益。提供「都不是」而不设计下一跳,只是把失败推迟一轮。
怎么落地
- 槽的合法值本来就少、且互斥,用封闭问;把选项说成用户会说的词,而不是内部标签。
- 集合外的真实需求若在语料里反复出现,给它一个显式出口(「都要」「都不是」),并接上能处理它的下一状态,不要把出口当成礼貌点缀。
- 不要用封闭问去收集必须原话保存的叙述;那类槽改用短开放,再在下一轮用封闭问核对关键字段。
- 验证:抽封闭问成功的会话做回顾,「你当时想办的是哪一件」。回顾与系统采纳不一致的,算表达偏差,不是识别成功。偏差高就加出口或拆槽,而不是再收紧词表。