X3.08.4Low-confidence confirmation request设计研究
低置信度场景应主动请求确认而非依高置信度阈值静默执行
别名: 低置信确认 · 主动澄清 · selective prediction
概念解释
低置信确认请求(low-confidence confirmation request)是在机器人对对象、指令或计划把握不足且错误后果不可忽略时,暂停提交并请人选择候选、补充信息或确认动作。单纯设置执行阈值会让阈值以上的边缘案例静默执行,也让阈值以下的案例只失败而不产生新证据。
机制
确认把人的上下文知识注入决策,能用一次低成本交互消除多个候选。最优触发取决于错误成本、确认成本和人的可用性,而不是固定置信值。请求若频繁、没有具体候选或总在同类场景出现,会产生打断负担,并暴露系统应自行改善的结构性缺陷。
怎么研究
可比较静默阈值、固定请求与成本敏感请求,测量错误避免、确认次数、响应时间、任务中断、无人回应时后果和长期依赖。模型置信需要校准,且确认答案自身可能错误。实验应覆盖用户忙碌、延迟响应和拒绝,不默认人总可用且正确。
边界
紧急控制窗口可能来不及确认,应直接采取已定义的安全动作。低风险且易撤销的选择可使用透明默认。高风险责任不能仅凭用户点一次确认转移;请求内容与权限必须匹配,未响应时保持保守状态。
怎么落地
- 用预期错误损失、确认代价和人员可用性决定触发,不只使用单一模型阈值。
- 请求中展示有限候选、关键差异和将要执行的动作,允许拒绝与稍后处理。
- 测试忙碌、误答和无人回应,统计每避免一次高后果错误所需确认数及由打断造成的新错误。