自动类发现和单次交互用于声学活动识别

荣誉提名
人体姿态与行为识别环境感知与上下文计算软件工程师与开发者AI/ML 研究员与工程师

声学活动识别已成为赋予设备基于上下文的能力的基础要素,使计算体验更加丰富、更具辅助性和适应性。传统方法依赖于现场训练的定制模型或在现有数据上预训练的通用模型,每种方法都有准确性和用户负担的影响。我们提出了Listen Learner,这是一种活动识别技术,可以在减少用户负担的同时逐渐学习特定于部署环境的事件。具体来说,我们建立了一个端到端的系统,用于通过一次交互标记的事件进行自我监督学习。我们在以下方面描述和量化了系统性能:1)在现有的音频数据集上,2)在我们收集的真实世界数据集上,3)通过用户研究,揭示了适合这种新型交互的系统行为。我们的结果显示,我们的系统可以跨环境准确且自动地学习声学事件(例如,97%的精度,87%的召回率),同时遵循用户对非侵入式交互行为的偏好。

快捷操作

分享

分享当前页面

ios_share

https://hci.top/zh/papers/chi/31839/2020

广告推荐

学习 AI 编程到 CodeNow

open_in_new打开DOI链接
DOI: https://doi.org/10.1145/3313831.3376875
一眼看懂

论文快照

fact_check
dataset
来源
CHI
calendar_month
年份
2020
emoji_events
奖项
荣誉提名
group
作者
4 位作者
sell
研究子方向
人体姿态与行为识别、环境感知与上下文计算
work
职业/产业
软件工程师与开发者、AI/ML 研究员与工程师
article
内容状态
仅摘要
hub
相关论文
7 篇相关论文