LabelAR:用于快速计算机视觉图像采集的空间引导界面

AR 导航与情境感知生成式AI(文本、图像、音乐、视频)软件工程师与开发者AI/ML 研究员与工程师

计算机视觉的应用范围不断扩大,许多应用需要自定义训练数据才能良好运行。我们提出了一种用于快速采集和标注训练图像的新型界面,用于改进基于计算机视觉的目标检测器。LabelAR 利用增强现实(AR)摄像头的空间追踪功能,允许用户放置持久的边界体积,使其保持在现实世界物体的中心。随后,该界面引导用户移动摄像头以覆盖各种视点。我们通过在从 AR 标记视点捕获图像时自动投影物体周围的二维边界框,消除了事后手动标注图像的需求。在 12 名用户的测试中,LabelAR 在模型性能与采集时间的权衡方面显著优于现有方法。

快捷操作

分享

分享当前页面

ios_share

https://hci.top/zh/papers/uist/6260/2019

广告推荐

学习 AI 编程到 CodeNow

一眼看懂

论文快照

fact_check
dataset
来源
UIST
calendar_month
年份
2019
emoji_events
奖项
未标记奖项
group
作者
5 位作者
sell
研究子方向
AR 导航与情境感知、生成式AI(文本、图像、音乐、视频)
work
职业/产业
软件工程师与开发者、AI/ML 研究员与工程师
article
内容状态
仅摘要
hub
相关论文
8 篇相关论文