D2.06.2Serial auditory channel设计研究
语音输出占用听觉通道,无法并行浏览
别名: auditory bottleneck · serial output · channel conflict
概念解释
语音输出独占听觉通道。屏幕上可以并排显示几十条信息,用户随时挑一条看;语音同一时刻只能说一句话,第二条必须等第一条说完。这种串行性决定了两条语音不能同时输出,也决定了用户无法边听一条边浏览另一条。
机制
言语理解需要把连续声流切分成词与句,这个过程依赖注意的持续投入,难以多路并行。当两路语音重叠时,用户通常只能听懂其中一路,另一路退化为噪声。这也解释了为什么语音助手在同一时刻收到多个待播消息时只能排队。与之对照,视觉可以并行采集多个区域,代价是需要在空间上分配注意;听觉没有等价的并行读取方式。
怎么研究
常用双任务与并发语音范式:让参与者同时听两条语音,测量其中一条的复述准确率;或让其在听取语音的同时执行视觉搜索任务,观察两者是否争用注意。因变量包括复述正确率、任务完成时间与主观负荷。研究需控制两条语音的相似度与信噪比,否则难以解释干扰来源。
边界
当第二条语音被设计为背景性质(低信息量、可忽略)时,并行并不需要发生,界面可以只保证主语音清晰。若用户是熟练的双语者或内容高度可预测,并行理解的负担会下降,但仍不等于可用。因此串行限制在「两条都需要被理解」的前提下最为严格。
怎么落地
- 同一时刻只播放一路需要被理解的语音,其余消息进入队列并给出队列状态。
- 让新消息的到达打断与恢复行为可预期,避免两条语音叠在一起。
- 为语音内容提供视觉摘要,使用户可以绕过听觉排队直接获取结果。
- 验证方式:构造同一时刻到达多条语音的场景,检查是否出现重叠播放,并请用户复述每条消息的内容,出现遗漏即为通道冲突未处理。