SonifyAR: 增强现实中的情境感知声音生成

AR 导航与情境感知生成式AI(文本、图像、音乐、视频)环境感知与上下文计算

声音在增强用户体验和沉浸感方面起着至关重要的作用。然而,当前平台缺乏对增强现实声音创作的支持,原因是交互类型有限、情境信息收集和指定困难,以及难以获取匹配的声音资产。我们提出SonifyAR,一个基于大语言模型的增强现实声音创作系统,可为增强现实体验生成情境感知的声音效果。SonifyAR扩展了当前增强现实声音的设计空间,并实现了编程演示管道来自动收集增强现实事件的情境信息,包括虚拟内容语义和真实世界上下文。然后,这些情境信息由大语言模型处理,通过推荐、检索、生成和传输方法获取声音效果。为了评估我们系统的可用性和性能,我们进行了八名参与者的用户研究,并创建了五个示例应用,包括基于增强现实的科学实验和低视力增强现实用户的辅助应用。

快捷操作

分享

分享当前页面

ios_share

https://hci.top/zh/papers/uist/170866/2024

广告推荐

学习 AI 编程到 CodeNow

open_in_new打开DOI链接
DOI: https://doi.org/10.1145/3654777.3676406
一眼看懂

论文快照

fact_check
dataset
来源
UIST
calendar_month
年份
2024
emoji_events
奖项
未标记奖项
group
作者
4 位作者
sell
研究子方向
AR 导航与情境感知、生成式AI(文本、图像、音乐、视频)、环境感知与上下文计算
work
职业/产业
—
article
内容状态
仅摘要
hub
相关论文
8 篇相关论文