语音练习系统的设计:用户控制的语音 manipulation 和模型说话人如何影响对自己声音的感知?

语音用户界面(VUI)设计语音可访问性

文献标题

Designing for Speech Practice Systems: How Do User-Controlled Voice Manipulation and Model Speakers Impact Self-Perceptions of Voice?

文献信息

  • 主题领域: 人机交互(HCI),公众演讲训练,自我感知和语音修正技术
  • 关键词: 公共演讲, 演讲训练, 语音操控, 示例语音, 自我感知, 性别与语音, 用户体验研究

研究背景与问题

  • 研究背景:

    • 演讲技能是人类沟通中的关键组成部分,但具体的改进方法可能难以确定。
    • 当前的演讲训练系统多强调基于外部评价和反馈的方法,而较少关注用户自我感知和自我评价的能力。
    • 尤其是女性和性别少数群体,常面临社会压力要求模仿男性所谓“权威性”的低沉声音,从而导致自我感知不足。
  • 研究问题:

    • 如何通过用户控制的语音操控和示范语音的使用提升用户对其自身语音和演讲的感知?
    • 是否可以设计一个语音练习系统来更好地支持用户提升自我感知?
  • 研究动机:

    • 现有研究表明,自我感知可提高演讲能力、自信心,以及对沟通技能的深刻认知,进而影响社会幸福感。
    • 通过探索语音操控和示范语音的结合,作者希望为性别少数群体提供更加个性化和高效的解决方案,增强其对自我声音和演讲能力的认知。

解决方案

  • 方法或解决方案:

    • 提出一种结合用户控制语音操控(voice manipulation)和示范语音(model audio)的演讲练习模式。
    • 设计实验以分析不同条件下这两种方法(单独使用或结合使用)对演讲者自我感知的影响。
  • 创新点:

    • 引入用户可控制的语音操作(例如通过Praat软件的音高和时长操控)以及高可辨识性交互设计。
    • 强调用户的自我评估,而非完全依赖外部系统评价。
    • 针对女性和性别少数群体,探讨社会和性别对语音感知的潜在影响。
  • 实施步骤:

    • 使用量化分析和定性访谈,研究用户控制语音操控和示范音频对用户信心、满意度、沟通和自我表达能力的影响。
    • 设计四种实验条件(结合或单独使用语音操控和示范语音)进行对比实验,以探索其对自我感知的提升作用。
    • 应用主题分析处理访谈和问卷数据,提炼出设计语音训练系统的关键建议。

研究成果

  • 具体成果:

    1. 量化实验分析:

      • 示范音频能显著增强用户在语调方面的自信心,但语音操控未在量化分析中表现出显著提升自我感知的效果。
      • 语音操控在提升自我表达方面显示出一定的积极趋势。
    2. 访谈与主题分析:

      • 使用声音操控软件(Praat)得到普遍认可,帮助用户通过即时听觉反馈和音频可视化了解自己的声音特点。
      • 大多数用户对示范音频评价积极,但部分用户仍感受到对比示范音频导致的压力。
      • 参与者反映,社会和性别身份对语音和演讲的感知有显著影响。
    3. 自我感知变化:

      • 用户在演讲满意度上较实验前显著提高,但信心、沟通能力和自我表达能力未显著提升。
  • 与现有解决方案的比较优势:

    • 鼓励用户主动参与语音调整过程,提高了他们的参与感和自我表达能力。
    • 注重语音练习中的个性化设计,支持用户根据自身特点优化技能。
  • 局限性与未来方向:

    • 局限性:
      • 样本数量较少,且全部为女性或性别少数群体,不具有一般性。
      • 所有练习内容基于提供的模板文本,未考虑用户自定义文本或面对观众的演讲情境。
      • 仅关注英语环境下的演讲训练,研究结果无法扩展到多语言或全球背景。
    • 未来方向:
      • 扩大样本规模,包含更多性别群体和语言背景。
      • 探讨动态观众反馈对自我感知的可能影响。
      • 进一步开发个性化音频建议系统,以弥补现有算法限制。

设计启示

  • 用户自定义语音操控:

    • 为用户提供更多控制选项,使其可以根据需要选择调整特定语音参数,如音调、频率和节奏。
    • 加强用户教育,帮助其理解如何通过语音操控提高演讲技能。
  • 示范音频的个性化定制:

    • 根据用户自身声音特征和演讲目标,推荐具有相似属性的示范音频,以提高其相关性和实用性。
    • 确保示范语音集多样化,包括不同性别、社会背景和口音的演讲者,以满足多样性需求。
  • 注释与可视化支持:

    • 为用户提供脚本注释功能,帮助记录和回忆修改语音时的重要要点。
    • 利用实时反馈和可视化工具,进一步提高用户语音操控的易用性和可理解性。

论文价值

  • 提供了演讲训练系统设计的新视角,帮助用户从自我评估和自我感知出发改善演讲技能。
  • 强调性别与社会因素在语音感知研究中的重要性,为未来研究与设计提供了启发。

快捷操作

分享

分享当前页面

ios_share

https://hci.top/zh/papers/chi/68730/2022

广告推荐

学习 AI 编程到 CodeNow

open_in_new打开DOI链接
DOI: https://dl.acm.org/doi/abs/10.1145/3491102.3502093
一眼看懂

论文快照

fact_check
dataset
来源
CHI
calendar_month
年份
2022
emoji_events
奖项
未标记奖项
group
作者
4 位作者
sell
研究子方向
语音用户界面(VUI)设计、语音可访问性
work
职业/产业
article
内容状态
已索引正文
hub
相关论文
4 篇相关论文