InstruMentAR:通过记录具身演示自动生成操作数字仪器的增强现实教程

车内触觉、声音、多模态反馈手部手势识别AR 导航与情境感知医生、护士、临床医生UI/UX 设计师产品设计师

文献标题

InstruMentAR: Auto-Generation of Augmented Reality Tutorials for Operating Digital Instruments Through Recording Embodied Demonstration

文献信息

  • 主题领域: 增强现实技术在数字仪器操作领域的应用与自动化教程生成
  • 关键词: 增强现实、沉浸式创作、身体操作示范、可穿戴设备、触觉反馈、交互式教程

研究背景与问题

  • 作者发现的问题或挑战: 当前的增强现实(AR)教程创作过程不够流畅,需要用户在操作仪器与交互虚拟元素之间频繁切换。这种手动调整虚拟箭头位置、尺寸和方向的过程不仅繁琐且易出现失误,尤其当任务步骤复杂时会加剧用户的认知负担。

  • 为什么这个问题很重要: 随着数字仪器的普及,人们对精准且直观的操作指南需求增加。相比传统教程(图片或视频),AR教程提供实时、直接视觉指引,可以减少用户的认知负荷,提高操作效率。

  • 研究动机与相关工作: 作者希望通过记录用户示范操作,自动生成增强现实教程,减少用户的负担并提高教程的生成效率。他们受相关工作启发,如利用摄像头记录装配任务中的物体轨迹,但面临手部遮挡与设备复杂性的限制,同时着眼于开发后续支持功能如实时反馈。

解决方案

  • 作者提出的方法: 设计并实现了InstruMentAR系统,该系统通过用户的身体操作演示自动生成增强现实教程。解决方案包括硬件与软件协同:

    • 一个带有压力传感器和触觉模块的定制手部可穿戴设备。
    • 基于手势跟踪与压力传感器的多模态检测算法,捕捉仪器操作。
    • Hololens 2平台上的教程创作与访问界面。
  • 该解决方案的创新之处:

    • 自动化生成教程,无需手动调整虚拟箭头。
    • 预警机制,通过触觉与视觉反馈避免用户错误操作。
    • 集成与仪器交互的无缝操作流程。
  • 实施步骤与关键技术:

    1. 创作模式: 用户通过佩戴手部设备操作仪器,系统记录压力传感器输入和手势轨迹,自动生成对应的虚拟箭头、补充文字和图像信息。
    2. 访问模式: 新手用户使用教程时,系统实时追踪其操作,根据正确步骤自动推进教程,并在错误操作发生前提供反馈。
    3. 硬件设计: 手部可穿戴设备优先减少对手势追踪的干扰,设计符合手指轮廓的压力传感器及触觉反馈模块。
    4. 多模态跟踪: 通过压力传感器检测操作起始和结束,通过手势数据确定操作位置和尺度。

研究成果

  • 具体成果:

    • 实现了一个自动生成增强现实教程的系统,包括支持五种仪器界面(按钮、拨键、旋钮、滑条、触摸屏)与多种手势组合的检测算法,以及实时反馈机制。
    • 用户研究表明该系统显著减少创作教程的时间(约46%),降低用户操作的认知负担。
  • 与现有解决方案相比的优势:

    • 自动化程度高:相比传统手动调整箭头位置的沉浸式AR创作工具,InstruMentAR极大地简化了教程创作流程。
    • 阻挡与设备适配问题得以优化:通过手部而非仪器界面的直接追踪减少阻挡问题。
    • 更强的容错机制:通过实时预警避免错误操作造成的挫败感。
  • 实验或评估结果:

    • 在检测模型性能测试中,系统操作准确率达到约88%,主要错误来源为手势追踪失败。
    • 用户对教程创作模式和访问模式的整体满意度较高,系统易用性评分为81/100(创作模式)和68/100(访问模式),表明具备良好的用户体验。
  • 局限性与未来方向:

    • 局限性:

      • 手部可穿戴设备存在一定的不适感,部分用户认为增加了操作复杂性。
      • 当前系统仅支持预设的操作手势,限制了个性化需求。
      • 教程生成与访问流程仅支持单线性路径,对用户错误操作恢复机制支持有限。
    • 未来方向:

      • 扩展手势识别能力,支持用户自定义手势及多点触控。
      • 引入仪器屏幕状态建模,通过分析仪器实时数据进一步优化教程生成与反馈机制。
      • 改进可穿戴设备设计,提升佩戴舒适度,并优化感知能力(如添加多传感器支持)。
      • 增强教程错误处理功能(如增加分支路径支持),提高教程容错性与灵活性。

快捷操作

分享

分享当前页面

ios_share

https://hci.top/zh/papers/chi/96353/2023

广告推荐

学习 AI 编程到 CodeNow

open_in_new打开DOI链接
DOI: https://doi.org/10.1145/3544548.3581442
一眼看懂

论文快照

fact_check
dataset
来源
CHI
calendar_month
年份
2023
emoji_events
奖项
未标记奖项
group
作者
8 位作者
sell
研究子方向
车内触觉、声音、多模态反馈、手部手势识别、AR 导航与情境感知
work
职业/产业
医生、护士、临床医生、UI/UX 设计师、产品设计师
article
内容状态
已索引正文
hub
相关论文
0 篇相关论文