HCI.TOPHCI, made easy
首页arXiv论文机构作者设计规范问题知识卡创新日程
首页arXiv论文机构作者设计规范问题知识卡创新日程
学习AI编程数据说明HCI 会议HCI 论文关于薛志荣
search
当前筛选
search
全部

论文

浏览与搜索 全部 的 HCI 研究论文

当前筛选
作者: 3803
共 11 条

HiSync:通过可穿戴IMU与机器人摄像头的时空对齐实现长距离人机交互中的命令源识别

Zhang等人提出HiSync光学-惯性融合框架,通过对齐机器人摄像头与手戴IMU信号,在34m范围内实现92.32%命令源识别准确率,显著提升长距离HRI可靠性。

CZ
Chengwen Zhang et al.清华大学

TraceRing: 通过个性化学习实现单IMU环的类触控板指向

He 等人提出TraceRing系统,使用多任务和对比学习实现单IMU环个性化指向,速度预测误差降低33.9%,任务完成时间超AirMouse。

ZH
Zhe He et al.清华大学

3DRing:通过融合惯性与低帧率光学传感实现低成本3D手部位置追踪

Li 等人提出3DRing低成本3D手部追踪方法,融合6.61 FPS光学数据与IMU环,实现1.75 cm追踪误差和86%交互效率,为移动设备手部追踪降低计算负载。

ZL
Zhuojun Li et al.清华大学

InterQuest:用于会话搜索中动态用户兴趣建模的混合主动式框架

Mei 等人提出基于LLM的会话搜索代理InterQuest,通过动态用户知识建模与不确定性驱动提问,在用户兴趣推断与知识建模准确性上显著优于基线。

YM
Yu Mei et al.清华大学
广告推荐

学习 AI 编程到 CodeNow

系统课程、实战项目、持续更新,适合想真正把 AI 用进开发流程的人。

立即查看open_in_new

从操作到认知:从用户演示中自动建模认知依赖关系以实现GUI任务自动化

Yin 等人提出 TaskMind 系统,从演示中自动识别操作语义和认知依赖关系构建任务图,在20名参与者研究中显著优于基线端到端LLM。

YY
Yiwen Yin et al.清华大学

使用大型语言模型在智能手机上进行上下文感知的协作文本输入研究

Chen等人提出基于LLM的智能手机协作文本输入系统CATIA,利用屏幕内容、时间、地点、活动等上下文提供文本建议,7天野外研究表明80%建议合适,揭示两种心理模型。

WC
Weihao Chen et al.清华大学

AngleSizer:通过交互式智能手机助手增强视障人士的空间尺度感知能力

Jing 等人开发 AngleSizer 交互式智能手机助手,通过创新方式帮助视障人士感知空间尺度,提升其对物体大小和距离的理解能力。

XJ
Xiaoqing Jing et al.

ContextCam:将情境感知与创意人机图像共创作相结合

Fan 等人提出 ContextCam 系统,融合情境感知与 Stable Diffusion,通过 LLM 多代理与用户共创作图像,16人136场景研究表明可提升创作参与度与乐趣。

XF
Xianzhe Fan et al.清华大学

从Gap到Synergy:通过人机协作增强个性化系统中的上下文理解

Chen 等人提出 LangAware 系统,利用大语言模型将低层传感器语义连接到高层上下文,使用户可通过自然语言定义上下文规则,在12种校园场景中成功率达87.50%,增强了对机器能力的理解

WC
Weihao Chen et al.清华大学

VIPBoard:通过字符级自动更正改进视障人士的屏幕阅读器键盘

Shi 等人设计 VIPBoard 智能键盘,通过语言模型预测字符概率并自动缩放布局,将视障用户触点错误率降低 63.0%,输入速度提升 12.6%

WS
Weinan Shi et al.清华大学

Lip-Interact:使用静音语音命令改进移动设备交互

Sun等人提出Lip-Interact技术,利用前置摄像头捕捉嘴部动作,通过深度学习模型支持44种静音语音命令,可实现单手高效操作与隐私保护的移动设备交互。

KS
Ke Sun et al.清华大学
论文标题作者研究主题论文库年份

HiSync:通过可穿戴IMU与机器人摄像头的时空对齐实现长距离人机交互中的命令源识别

Zhang等人提出HiSync光学-惯性融合框架,通过对齐机器人摄像头与手戴IMU信号,在34m范围内实现92.32%命令源识别准确率,显著提升长距离HRI可靠性。

CZ
Chengwen Zhang et al.清华大学

TraceRing: 通过个性化学习实现单IMU环的类触控板指向

He 等人提出TraceRing系统,使用多任务和对比学习实现单IMU环个性化指向,速度预测误差降低33.9%,任务完成时间超AirMouse。

ZH
Zhe He et al.清华大学

3DRing:通过融合惯性与低帧率光学传感实现低成本3D手部位置追踪

Li 等人提出3DRing低成本3D手部追踪方法,融合6.61 FPS光学数据与IMU环,实现1.75 cm追踪误差和86%交互效率,为移动设备手部追踪降低计算负载。

ZL
Zhuojun Li et al.清华大学

InterQuest:用于会话搜索中动态用户兴趣建模的混合主动式框架

Mei 等人提出基于LLM的会话搜索代理InterQuest,通过动态用户知识建模与不确定性驱动提问,在用户兴趣推断与知识建模准确性上显著优于基线。

YM
Yu Mei et al.清华大学
广告推荐

学习 AI 编程到 CodeNow

系统课程、实战项目、持续更新,适合想真正把 AI 用进开发流程的人。

立即查看open_in_new

从操作到认知:从用户演示中自动建模认知依赖关系以实现GUI任务自动化

Yin 等人提出 TaskMind 系统,从演示中自动识别操作语义和认知依赖关系构建任务图,在20名参与者研究中显著优于基线端到端LLM。

YY
Yiwen Yin et al.清华大学

使用大型语言模型在智能手机上进行上下文感知的协作文本输入研究

Chen等人提出基于LLM的智能手机协作文本输入系统CATIA,利用屏幕内容、时间、地点、活动等上下文提供文本建议,7天野外研究表明80%建议合适,揭示两种心理模型。

WC
Weihao Chen et al.清华大学

AngleSizer:通过交互式智能手机助手增强视障人士的空间尺度感知能力

Jing 等人开发 AngleSizer 交互式智能手机助手,通过创新方式帮助视障人士感知空间尺度,提升其对物体大小和距离的理解能力。

XJ
Xiaoqing Jing et al.

ContextCam:将情境感知与创意人机图像共创作相结合

Fan 等人提出 ContextCam 系统,融合情境感知与 Stable Diffusion,通过 LLM 多代理与用户共创作图像,16人136场景研究表明可提升创作参与度与乐趣。

XF
Xianzhe Fan et al.清华大学

从Gap到Synergy:通过人机协作增强个性化系统中的上下文理解

Chen 等人提出 LangAware 系统,利用大语言模型将低层传感器语义连接到高层上下文,使用户可通过自然语言定义上下文规则,在12种校园场景中成功率达87.50%,增强了对机器能力的理解

WC
Weihao Chen et al.清华大学
emoji_events

VIPBoard:通过字符级自动更正改进视障人士的屏幕阅读器键盘

Shi 等人设计 VIPBoard 智能键盘,通过语言模型预测字符概率并自动缩放布局,将视障用户触点错误率降低 63.0%,输入速度提升 12.6%

WS
Weinan Shi et al.清华大学

Lip-Interact:使用静音语音命令改进移动设备交互

Sun等人提出Lip-Interact技术,利用前置摄像头捕捉嘴部动作,通过深度学习模型支持44种静音语音命令,可实现单手高效操作与隐私保护的移动设备交互。

KS
Ke Sun et al.清华大学