HCI.TOPHCI, made easy
首页arXiv论文机构作者设计规范问题知识卡创新日程
首页arXiv论文机构作者设计规范问题知识卡创新日程
学习AI编程数据说明HCI 会议HCI 论文关于薛志荣
search
当前筛选
search
全部

论文

浏览与搜索 全部 的 HCI 研究论文

当前筛选
作者: 13179
共 11 条

AgentHands:为 XR 空间中智能体对话生成交互式手势

Liu 等人提出 AgentHands 系统,通过 LLM 生成与言语同步的空间感知手势,在 XR 环境中增强智能体对话的参与度和可理解性,填补了文本语音沟通中的空间表达缺口。

ZL
Ziyi Liu et al.普渡大学

Sensible Agent: 面向主动式 AR 代理无干扰交互的框架

Lee 等人提出 Sensible Agent 框架,利用多模态感知和 LMM 推断用户上下文,显著降低 AR 代理交互的侵入性和认知负担。

GL
Geonsun Lee et al.马里兰大学

Thing2Reality:在 XR 会议中使用生成式 AI 实现从 2D 内容即时创建 3D 对象

Hu 等人开发 Thing2Reality 平台,利用生成式 AI 在 XR 会议中即时将 2D 内容转换为可交互的 3D 对象或多视图渲染,显著提升远程协作讨论效率。

EH
Erzhen Hu et al.弗吉尼亚大学

DialogLab:构建、模拟与测试动态人机群组对话的创作工具

Hu 等人开发 DialogLab 原型工具包,支持人机混合群组对话的创作、模拟与测试,通过整合结构化脚本与可配置代理的即兴创作能力,提升对话设计的真实性和适应性。

EH
Erzhen Hu et al.弗吉尼亚大学
广告推荐

学习 AI 编程到 CodeNow

系统课程、实战项目、持续更新,适合想真正把 AI 用进开发流程的人。

立即查看open_in_new

InstructPipe: 使用人类指令和大语言模型生成视觉块管道

Zhou 等人提出 InstructPipe,利用两个大型语言模型和代码解释器,通过文本指令原型化机器学习管道,16人评估显示可减少学习曲线并激发创新。

ZZ
Zhongyi Zhou et al.谷歌

XR-Objects:增强物体智能与扩展现实

Dogan等人提出增强物体智能(AOI)概念与XR-Objects系统,利用实时对象分割与多模态大语言模型,使现实物体无需预注册即可作为数字功能门户,实现物理与数字环境的无缝交互。

MD
Mustafa Doga Dogan et al.奥多比

ChatDirector:通过空间感知场景渲染和语音驱动布局转换增强视频会议

Qian等人提出ChatDirector,通过实时RGB视频流转换为3D肖像头像并利用决策树算法根据语音状态指导布局,显著提升远程沟通效率。

XQ
Xun Qian et al.普渡大学

人类I/O:迈向检测情境障碍的统一方法

Liu等人提出Human I/O方法,利用第一人称视觉与LLM推理在32种场景中实现82%可用性预测准确率,MAE仅0.22。

XL
Xingyu Bruce Liu et al.加利福尼亚大学

XR中的UI移动性控制:在静态、动态和自我实体之间切换UI位置

Pei等人研究XR中UI在静态、动态和自我实体间的移动控制,对11人需求发现和113款应用调查,仅6.2%支持UI过渡,提出FingerSwitches技术原型验证有效性。

SP
Siyou Pei et al.加利福尼亚大学

RetroSphere: 用于增强现实的自主式被动3D控制器追踪

Balaji 等人开发 RetroSphere 系统,使用3个回复反射球和立体红外追踪器实现6DoF控制器追踪,精度约96.5%,功耗仅400mW,可集成至轻量级AR设备。

AB
Ananta Narayanan Balaji et al.新加坡国立大学

DepthLab:移动增强现实中基于深度图的实时3D交互

Du等人开发了DepthLab软件库,封装几何感知渲染、表面交互和视觉效果等深度UX范式,为移动AR开发者提供轻松的深度集成方案。

RD
Ruofei Du et al.谷歌
论文标题作者研究主题论文库年份

AgentHands:为 XR 空间中智能体对话生成交互式手势

Liu 等人提出 AgentHands 系统,通过 LLM 生成与言语同步的空间感知手势,在 XR 环境中增强智能体对话的参与度和可理解性,填补了文本语音沟通中的空间表达缺口。

ZL
Ziyi Liu et al.普渡大学

Sensible Agent: 面向主动式 AR 代理无干扰交互的框架

Lee 等人提出 Sensible Agent 框架,利用多模态感知和 LMM 推断用户上下文,显著降低 AR 代理交互的侵入性和认知负担。

GL
Geonsun Lee et al.马里兰大学

Thing2Reality:在 XR 会议中使用生成式 AI 实现从 2D 内容即时创建 3D 对象

Hu 等人开发 Thing2Reality 平台,利用生成式 AI 在 XR 会议中即时将 2D 内容转换为可交互的 3D 对象或多视图渲染,显著提升远程协作讨论效率。

EH
Erzhen Hu et al.弗吉尼亚大学

DialogLab:构建、模拟与测试动态人机群组对话的创作工具

Hu 等人开发 DialogLab 原型工具包,支持人机混合群组对话的创作、模拟与测试,通过整合结构化脚本与可配置代理的即兴创作能力,提升对话设计的真实性和适应性。

EH
Erzhen Hu et al.弗吉尼亚大学
广告推荐

学习 AI 编程到 CodeNow

系统课程、实战项目、持续更新,适合想真正把 AI 用进开发流程的人。

立即查看open_in_new
emoji_events

InstructPipe: 使用人类指令和大语言模型生成视觉块管道

Zhou 等人提出 InstructPipe,利用两个大型语言模型和代码解释器,通过文本指令原型化机器学习管道,16人评估显示可减少学习曲线并激发创新。

ZZ
Zhongyi Zhou et al.谷歌

XR-Objects:增强物体智能与扩展现实

Dogan等人提出增强物体智能(AOI)概念与XR-Objects系统,利用实时对象分割与多模态大语言模型,使现实物体无需预注册即可作为数字功能门户,实现物理与数字环境的无缝交互。

MD
Mustafa Doga Dogan et al.奥多比

ChatDirector:通过空间感知场景渲染和语音驱动布局转换增强视频会议

Qian等人提出ChatDirector,通过实时RGB视频流转换为3D肖像头像并利用决策树算法根据语音状态指导布局,显著提升远程沟通效率。

XQ
Xun Qian et al.普渡大学
emoji_events

人类I/O:迈向检测情境障碍的统一方法

Liu等人提出Human I/O方法,利用第一人称视觉与LLM推理在32种场景中实现82%可用性预测准确率,MAE仅0.22。

XL
Xingyu Bruce Liu et al.加利福尼亚大学

XR中的UI移动性控制:在静态、动态和自我实体之间切换UI位置

Pei等人研究XR中UI在静态、动态和自我实体间的移动控制,对11人需求发现和113款应用调查,仅6.2%支持UI过渡,提出FingerSwitches技术原型验证有效性。

SP
Siyou Pei et al.加利福尼亚大学

RetroSphere: 用于增强现实的自主式被动3D控制器追踪

Balaji 等人开发 RetroSphere 系统,使用3个回复反射球和立体红外追踪器实现6DoF控制器追踪,精度约96.5%,功耗仅400mW,可集成至轻量级AR设备。

AB
Ananta Narayanan Balaji et al.新加坡国立大学

DepthLab:移动增强现实中基于深度图的实时3D交互

Du等人开发了DepthLab软件库,封装几何感知渲染、表面交互和视觉效果等深度UX范式,为移动AR开发者提供轻松的深度集成方案。

RD
Ruofei Du et al.谷歌