私人和公共场合中对口语和静默语音输入方法的可接受性

语音用户界面(VUI)设计语音可访问性

文献标题

Acceptability of Speech and Silent Speech Input Methods in Private and Public

文献信息

  • 主题领域: 人机交互、语音输入、隐私与安全
  • 关键词: 默语输入, 语音输入, 社会接受度, 人机交互, 如果语音助手, 无接触交互

研究背景与问题

  • 发现的问题或挑战:
    • 尽管语音输入已成为移动设备人机交互的重要方式,但在公共场所的隐私和安全问题上存在显著的挑战。
    • 默语输入(通过嘴唇和舌头的运动转换为文本)被认为是语音输入的潜在替代方式,但关于用户接受度的研究尚少。
  • 重要性:
    • 在公共场所提高输入方法的社会接受度,能增强用户体验和技术普及,同时保护隐私和安全。
  • 研究动机与相关工作:
    • 默语输入技术已被初步证明具有应用潜力,特别是在支持语音受损人群或嘈杂环境中。然而,其社会适应度、错误容忍度以及反馈设计的相关问题仍尚未充分探索。

解决方案

  • 方法或解决方案:
    • 进行三项用户研究:社会接受度评估、错误容忍度分析和反馈机制设计对比。
  • 创新之处:
    • 从用户和他人(观察者)的角度同时评估两种输入方式的社会接受度。
    • 引入注入错误的“巫师实验法”研究用户对错误的容忍度。
    • 比较视频反馈与抽象反馈的用户接受度,并对隐私和安全性进行全面分析。
  • 实施步骤和关键技术:
    1. 社会接受度测试:
      • 在线调查,展示默语和语音输入两种方法的使用视频。
      • 在不同场景(如家中、餐厅、办公室)询问用户的舒适程度。
    2. 错误容忍度实验:
      • 使用“巫师实验法”模拟不同的错识别率(0%、5%、10%、15%、20%)评估用户的容忍水平。
    3. 反馈机制实验:
      • 比较视频反馈(实时显示摄像头捕捉的视频)和抽象反馈(显示灰点或闪烁的红点)的用户体验,包括隐私、安全和有效性。

研究成果

  • 具体成果:
    • 用户普遍更接受默语输入,认为其隐私性和安全性更高,尤其在公共场所。
    • 当识别错误率在10%-15%时,用户对默语输入的容忍度更高,仍愿意使用;但对语音输入的容忍度较低。
    • 用户认为视频反馈能提供更详细的信息,但抽象反馈更注重隐私和安全,且不干扰使用体验。
  • 与现有解决方案的比较:
    • 默语输入较语音输入更适合公共与私密场景,尤其是对隐私安全要求较高的用户。
    • 抽象反馈低侵扰性优势彰显,与视频反馈相比更能让用户心理舒适。
  • 实验或评估结果:
    • 用户倾向于默语输入,但仅当错误率控制在合理范围(5%-10%)内时才具有广泛吸引力。
    • 抽象反馈在不牺牲有效性的前提下显著提升了用户对隐私与安全的正面评价。
  • 局限性与未来方向:
    • 局限于样本的地理和文化多样性,该成果未必适用于所有文化与背景。
    • “巫师实验法”模拟的测试欠缺真实技术开发环境中的时延等技术难题研究。
    • 后续应开发真实移动设备上的默语输入应用,并进行长期用户研究以验证其广泛适用性和用户习惯的影响。

快捷操作

分享

分享当前页面

ios_share

https://hci.top/zh/papers/chi/47888/2021

广告推荐

学习 AI 编程到 CodeNow

open_in_new打开DOI链接
DOI: https://doi.org/10.1145/3411764.3445430
一眼看懂

论文快照

fact_check
dataset
来源
CHI
calendar_month
年份
2021
emoji_events
奖项
未标记奖项
group
作者
3 位作者
sell
研究子方向
语音用户界面(VUI)设计、语音可访问性
work
职业/产业
—
article
内容状态
已索引正文
hub
相关论文
4 篇相关论文