可播报的选项数量受工作记忆限制
别名: 口头选项上限 · 一次能记住几项 · spoken choice-set size
概念解释
智能音箱问「白噪声要哪一种:雨声、海浪、篝火、风扇、森林、溪流、雷雨」。七个新标签依次进耳朵,能同时稳住、拿来做选择的,通常只有大约四项上下。超过这个容量,多出来的不是「多一个备选」,而是把前面还没选定的项挤出缓冲区。口头选项的工作记忆上限(working-memory cap on spoken options)限制的是一次能播报、并仍可被当作集合来选的数量,不是识别器能念多少个词。
机制
视觉列表把容量卸到纸面或屏幕上,工作记忆只抓住当前焦点。口头选项没有卸货地点,整组都要在语音环里复述才能保持激活。容量不是固定的「七加减二」:对不熟悉、彼此相似的标签,Cowan 意义上的注意焦点更接近四、甚至更少;声学近邻(「森林 / 风扇」)还会在复述时互相替换。每增加一项,复述负荷上升,用于「我到底要哪个」的决策资源下降。人会提前截断——听到第三项觉得「也行」就选了——不是偏好,是缓冲区告急。
数量上限和「听完能否回看」是两层:三项也可能因为无法回看而选错;七项则是连缓冲区都装不下,回看与否已经不是主因。把上限理解成朗读技巧问题,会去优化怎么念这七项,而不是先把七项砍成三项。
怎么研究
做口头选择集的跨度实验:N 从 2 增到 8,每项都是新的、无事先组块的标签(白噪声名、闹钟音色、烹饪模式)。听完后立刻选一个符合给定标准的项(「最安静的」「适合睡觉的」),或自由点名想要的那一个。因变量:命中率、错选邻近项的比例、要求完整重播的次数。曲线通常在 4 附近拐折,而不是在 7。
加上认知负荷:一边做简单心算或跟踪次任务,一边听菜单。占用条件下拐点前移,说明上限随可用工作记忆收缩,不是一个产品常数。实验室若允许被试在纸上涂选项,测到的就不是口头容量。
边界
封闭、每日使用的词表(「播放 / 暂停 / 下一首」)已经被练成组块,表面三项实际只占一个槽。专家调度口令可以更长,因为结构是他们的,不是当轮学的。选项若能靠世界知识立刻过滤(七个城市名里只有一个是用户常去的),有效集合在听到之前就已经小于 N。屏幕在场时,容量卸到视觉,口头播报的条数不再受这条上限约束——受约束的是无屏、且选项对用户是新的那些回合。
怎么落地
- 一次口头出示的新选项按 3–4 项封顶来设计;第五项开始默认先筛(「要自然环境还是室内声」)再出示子集。
- 不要用「还能念」当验收:合成器念七个名字的代价接近零,工作记忆的代价不是零。
- 高频、稳定的小词表可以略超,但要把它们当组块验收(用户能不经重播就点名),不能把一次性的长菜单混进同一配额。
- 验证:同一技能做 N=3 与 N=7 两条。N=7 上命中率掉、重播请求升、或人选了最后听到的那项充数,就还在上限之外。