仅通过音频交互识别语音输入错误
语音可访问性内容创作者(YouTuber、Podcaster)
语音已成为越来越常见的文本输入方式,从智能手机和智能手表到基于语音的智能个人助手。然而,当没有视觉反馈时,审查识别的文本以识别和纠正错误是一个挑战。在本文中,我们首先量化并描述了用户容易忽略的语音识别错误,并研究了通过操纵单词之间的停顿、语速和语音重复来更好地支持这一错误识别任务的方法。为了实现这些目标,我们进行了一系列四项研究。第一项研究是在实验室进行的,结果显示,当参与者听取识别文本的音频输出时,他们错过了超过50%的语音识别错误的识别。在此结果的基础上,第二至第四项研究是在在线众包平台上进行的,结果显示,在单词之间添加停顿可以提高错误识别率,与不添加停顿相比,更高的语速(300字/分钟)会降低错误识别能力,重复语音输出并不能提高错误识别。我们得出了仅使用音频的语音听写设计的启示。
研究问题 / 现实痛点
这篇论文在当前问题库中对应的问题线索。
当前问题库还没有收录这篇论文的问题与痛点。
暂无符合条件(≥60% 相似度)的相关论文
基于研究子主题与职业分类的 Jaccard 相似度(≥60%)
快捷操作
一眼看懂
fact_check论文快照
dataset
来源
CHI
calendar_month
年份
2018
emoji_events
奖项
未标记奖项
group
作者
2 位作者
sell
研究子方向
语音可访问性
work
职业/产业
内容创作者(YouTuber、Podcaster)
article
内容状态
仅摘要
hub
相关论文
0 篇相关论文