音频标注是开发机器听觉系统的关键;然而,有效获取准确快速众包音频标注的方法尚未得到充分研究。在这项工作中,我们寻求量化众包音景标注中的可靠性/冗余度权衡,探究可视化如何影响准确性和效率,并表征性能如何随音频特征变化而变化。通过控制实验,我们向人类标注者呈现了不同的声音可视化和复杂度的音景。结果显示,更复杂的音频场景导致标注者之间的一致性降低,而声谱图可视化在更低的时间和人力成本下产生更高质量的标注。我们还发现音景复杂度对召回率的影响大于精确度,且错误往往可归因于某些声音事件特征。这些发现不仅对如何设计音频数据的标注任务和界面有启示,也对如何训练和评估机器听觉系统有启示。

快捷操作

分享

分享当前页面

ios_share

https://hci.top/zh/papers/cscw/4739/2018

广告推荐

学习 AI 编程到 CodeNow

一眼看懂

论文快照

fact_check
dataset
来源
CSCW
calendar_month
年份
2018
emoji_events
奖项
未标记奖项
group
作者
9 位作者
sell
研究子方向
—
work
职业/产业
—
article
内容状态
仅摘要
hub
相关论文
0 篇相关论文