Reality Proxy:通过抽象表示实现MR中真实物体的流体交互
作者
混合现实工作空间生成式AI(文本、图像、音乐、视频)大语言模型(LLM)的人机协作软件工程师与开发者数据科学家与分析师AI/ML 研究员与工程师
在混合现实(MR)中与真实物体交互往往很困难,尤其是当它们拥挤、遥远或部分遮挡时,这会阻碍直接的选择和操作。我们注意到这些困难源于直接在物理物体上执行交互,输入与其物理约束紧密耦合。我们的关键见解是通过引入代理(proxies)——真实物体的抽象表示——来解耦交互与这些约束。我们在 Reality Proxy 中体现这一概念,该系统可在选择时将交互目标从物理物体无缝转移到其抽象表示。除了促进基本选择外,Reality Proxy 还使用AI为代理丰富对应物理物体的语义属性和层次空间关系,从而实现MR中新颖且此前繁琐的交互——如浏览、基于属性的过滤、导航嵌套组和复杂的多对象选择——均无需新的手势或菜单系统。我们展示了 Reality Proxy 在多种场景中的通用性,包括办公信息检索、大规模空间导航和多无人机控制。专家评估表明了该系统的实用性和可用性,表明基于代理的抽象为未来MR系统提供了一种强大且可推广的交互范式。
研究问题 / 现实痛点
这篇论文在当前问题库中对应的问题线索。
当前问题库还没有收录这篇论文的问题与痛点。
- 71%
使多模态大语言模型成为可靠的图表数据提取器:基准测试与训练框架
CHI '26· 生成式AI(文本、图像、音乐、视频) +2
- 67%
使用生成语言模型发现自然语言编程的语法和策略
CHI '22· 生成式AI(文本、图像、音乐、视频) +1
- 67%
幻灯片4N:通过人与AI协作从计算笔记本创建演示文稿
CHI '23· 生成式AI(文本、图像、音乐、视频) +1
- 67%
《它想让我怎么说》:弥合最终用户程序员与代码生成大型语言模型之间的抽象差距
CHI '23· 生成式AI(文本、图像、音乐、视频) +1
- 67%
D-Twins:专为实时无聊干预设计的数字双胞胎
CHI '25· 生成式AI(文本、图像、音乐、视频) +1
- 67%
接受、拒绝还是修正:人机协作中生产力与信任的度量
IUI '24· 生成式AI(文本、图像、音乐、视频) +1
基于研究子主题与职业分类的 Jaccard 相似度(≥60%)
快捷操作
广告推荐
学习 AI 编程到 CodeNow
open_in_new打开DOI链接
DOI: https://doi.org/10.1145/3746059.3747709
一眼看懂
fact_check论文快照
dataset
来源
UIST
calendar_month
年份
2025
emoji_events
奖项
未标记奖项
group
作者
5 位作者
sell
研究子方向
混合现实工作空间、生成式AI(文本、图像、音乐、视频)、大语言模型(LLM)的人机协作
work
职业/产业
软件工程师与开发者、数据科学家与分析师、AI/ML 研究员与工程师
article
内容状态
仅摘要
hub
相关论文
6 篇相关论文