D2.07.1Non-scannable audio stream设计研究

声音随时间展开,无法一眼扫描

别名: auditory linearity · no overview · random access

概念解释

听觉信息是线性的、不可扫描的。一段声音只能从头按时间往后播放,用户既无法一眼看出里面有几项、都是什么,也无法直接跳到中间某一项。屏幕上的「扫一眼」在听觉里没有对应动作,只能靠完整听完或反复重听。

机制

根本约束是声音以时间为唯一载体,而时间是单维且不可逆的。视觉可以把整页内容同时投射到视网膜,让注意自由地在外围与中心之间跳跃;听觉必须把物理信号逐段累积成心理表征,因此「总览」和「随机访问」都变成需要额外代价的操作。声音还会被更早的内容掩蔽:听到后面的内容时,前面内容已经不在信号里,只存在于记忆中。

怎么研究

可比较同一内容的听觉与视觉版本在总览与定位任务上的表现:让用户估计条目总数、判断某项是否存在、跳到指定条目,记录完成时间与正确率。听觉菜单研究通过位置与选择时间的关系,检验选择是否随位置线性增长而无捷径。研究需报告播放速率与是否允许重听,否则结论无法比较。

边界

当内容很短或用户只需判断单一结论时,不可扫描并不构成障碍,例如「已完成」。当用户经过训练、已对固定音频结构形成预期时,导航成本会下降,但仍不等于可以扫描。若界面提供视觉索引与关键词,实际的扫描需求被转移到视觉通道,听觉的线性限制就不再是主要瓶颈。

怎么落地

  • 不要指望用户从音频里获得整体概览,把条目数量、类别与当前进度同时放在屏幕上。
  • 为音频提供可跳转的定位手段,例如章节标记、序号索引或关键词直达。
  • 允许变速与跳过,使用户不必为了第 8 项而听完前 7 项。
  • 验证方式:给出含有目标条目的音频流,记录用户定位到它的时间与操作步数;若必须顺序听完,说明缺少定位机制。

延伸

  • 同组D2.07.2 长列表在听觉通道中成本极高 · D2.07.3 听觉界面需要更强的结构提示
  • 相邻D2.06.2 语音输出占用听觉通道,无法并行浏览 · D2.12 声音与字幕的等效
  • 站内检索auditory linearity · non-scannable · random access

同组卡片

快捷操作

分享

分享当前页面

ios_share

https://hci.top/zh/handbook/D2.07.1