Soundr:使用麦克风阵列预测头部位置和方向

眼动追踪与注视交互家庭语音助手使用体验

尽管最先进的智能扬声器可以听到用户的语音,但与人类助手不同,这些设备无法根据用户头部的位置和方向来理解用户的口头引用。Soundr提出了一种新的交互技术,利用大多数智能扬声器内置的麦克风阵列,仅通过用户的语音来推断用户的空间位置和头部方向。有了这些额外的信息,Soundr可以根据说话者的目光来理解用户对物体、人物和地点的引用,并提供相对的方向。为了提供我们神经网络的训练数据,我们从人类说话者那里收集了751分钟的数据(是之前最佳工作的50倍),利用虚拟现实头盔来准确提供头部跟踪的基准。我们的结果实现了每个语音命令的平均位置误差为0.31米,方向角度准确度为34.3°。一项用户研究评估了用户对通过与之交谈来控制物联网设备的偏好,发现这种方法快速且易于使用。

快捷操作

分享

分享当前页面

ios_share

https://hci.top/zh/papers/chi/31972/2020

广告推荐

学习 AI 编程到 CodeNow

open_in_new打开DOI链接
DOI: https://doi.org/10.1145/3313831.3376427
一眼看懂

论文快照

fact_check
dataset
来源
CHI
calendar_month
年份
2020
emoji_events
奖项
未标记奖项
group
作者
5 位作者
sell
研究子方向
眼动追踪与注视交互、家庭语音助手使用体验
work
职业/产业
—
article
内容状态
仅摘要
hub
相关论文
0 篇相关论文