M3.05.2do not duplicate voice and screen verbatim设计研究

两个通道不应逐字重复

别名: 通道不要复读 · redundant multimodal speech · 屏上写的不要再念一遍

概念解释

语音和屏幕不要把同一串字送两遍。车载抬头显示已经写着「200 米右转」,喇叭再把这六个字念完,耳朵被占住,路上的声音进不来,眼睛也没有多得到任何字段。带屏助手若把 TTS 全文再画成聊天气泡,是同一个字符串进了两个槽。逐字重复(verbatim duplication)看起来像稳妥的双编码,其实是把慢通道再播一遍已经在快通道上的东西。

机制

相同编码的冗余消耗两倍时间,不增加第二种表征。言语慢;把屏上的段落再 TTS 一遍,等于把眼睛已经有的东西串行化,并且堵住耳朵去听路、听乘客、听下一句真正的结论。互补要的是同一处境的不同编码:视觉给精确字段,语音给要旨、或那个不该还要去找的字段。逐字重复常常是实现偷懒——同一字符串灌进两个出口。听者会学会忽略其中一条;两条以后一旦分叉,被忽略的那条就真的丢了。重复的那句结论可以重叠;重复的整段不行。

怎么研究

同一条消息三种写法:甲,两通道逐字相同;乙,语音只给要旨、屏幕给字段;丙,只有屏幕。因变量:只出现在一个通道上的字段还能不能被回忆、主观厌烦、驾驶模拟里目光离路。自变量:字符串长度。不要把两通道谁先谁后当成自变量。

问卷上人会说「我也喜欢再听一遍」,同时正确率没有增益。以字段回忆和厌烦为准,不要以「喜欢双通道」为准。

边界

关键警报可以故意双编码(同一句警告又写又说),图的是鲁棒,不是信息密度,要单独标明。语言学习把听到的话写出来是教学目的,不是产品偷懒。眼睛正盯着这块屏时,逐字重复最浪费。短到两三个词的标签重叠可以接受;段落级重叠不行。

怎么落地

  • 禁止把同一字符串同时喂给 TTS 和卡片标题。
  • 语音只承担一个命题;其余留在屏上。
  • 把 TTS 稿和屏上可见字符串做一次 diff:允许重叠的是结论那一小句,不是整段。
  • 验证:抽真实会话的口头稿和截屏。大段红字重叠,就是逐字重复。再问听者屏上多出来的字段,答不出,说明他们靠听的那条把看的那条关掉了。

延伸

  • 同组M3.05.1 屏幕承担列表与细节,语音承担结论 · M3.05.3 无屏场景需要独立设计而非降级
  • 相邻M3.10 语音与屏幕的多模态互补 · M3.11 语音输出的信息裁剪 · M3.03 长列表朗读
  • 站内检索do not duplicate voice and screen verbatim · redundant multimodal · complementarity not redundancy

同组卡片

快捷操作

分享

分享当前页面

ios_share

https://hci.top/zh/handbook/M3.05.2