仅通过音频交互识别语音输入错误

语音可访问性内容创作者(YouTuber、Podcaster)

语音已成为越来越常见的文本输入方式,从智能手机和智能手表到基于语音的智能个人助手。然而,当没有视觉反馈时,审查识别的文本以识别和纠正错误是一个挑战。在本文中,我们首先量化并描述了用户容易忽略的语音识别错误,并研究了通过操纵单词之间的停顿、语速和语音重复来更好地支持这一错误识别任务的方法。为了实现这些目标,我们进行了一系列四项研究。第一项研究是在实验室进行的,结果显示,当参与者听取识别文本的音频输出时,他们错过了超过50%的语音识别错误的识别。在此结果的基础上,第二至第四项研究是在在线众包平台上进行的,结果显示,在单词之间添加停顿可以提高错误识别率,与不添加停顿相比,更高的语速(300字/分钟)会降低错误识别能力,重复语音输出并不能提高错误识别。我们得出了仅使用音频的语音听写设计的启示。

快捷操作

分享

分享当前页面

ios_share

https://hci.top/zh/papers/chi/3809/2018

广告推荐

学习 AI 编程到 CodeNow

一眼看懂

论文快照

fact_check
dataset
来源
CHI
calendar_month
年份
2018
emoji_events
奖项
未标记奖项
group
作者
2 位作者
sell
研究子方向
语音可访问性
work
职业/产业
内容创作者(YouTuber、Podcaster)
article
内容状态
仅摘要
hub
相关论文
0 篇相关论文