HCI.TOPHCI, made easy
首页arXiv论文机构作者设计规范问题知识卡创新日程
首页arXiv论文机构作者设计规范问题知识卡创新日程
学习AI编程数据说明HCI 会议HCI 论文关于薛志荣
search
当前筛选
search
全部

论文

浏览与搜索 全部 的 HCI 研究论文

当前筛选
作者: 6562
共 13 条

StepWrite:用于语音驱动文本生成的适应性规划

Alaoui 等人提出 StepWrite 系统,通过上下文感知的非视觉音频提示引导用户进行结构化长文本语音撰写,显著降低认知负荷并提升移动场景下的写作效率。

HA
Hamza El Alaoui et al.卡内基梅隆大学

Morae:主动暂停UI代理以供用户选择

Peng 等人提出 Morae UI 代理系统,通过大模型自动识别决策点并暂停交互,使盲人用户能够参与选择过程,在真实网络任务中显著提升任务完成率和偏好匹配度。

YP
Yi-Hao Peng et al.卡内基梅隆大学

CodeA11y:使AI编码助手对可访问的网络开发有用

Mowar 等人开发CodeA11y扩展,解决AI编码助手忽略可访问性问题,通过提醒和代码建议指导新手开发人员,符合WCAG标准的Web UI代码。

PM
Peya Mowar et al.卡内基梅隆大学

UIClip:用于评估用户界面设计的数据驱动模型

Wu 等人提出UIClip数据驱动模型,通过大规模标注数据集训练可对UI截图进行质量评分和建议,在与12位设计师的评估中达到最高一致率。

JW
Jason Wu et al.卡内基梅隆大学
广告推荐

学习 AI 编程到 CodeNow

系统课程、实战项目、持续更新,适合想真正把 AI 用进开发流程的人。

立即查看open_in_new

"这让我们真的能看到整个世界:" 为居家老年人设计对话式远程临场机器人

Hu 等人设计了一款对话式远程临场机器人,通过需求发现和技术探测研究,识别出机器人引导探索与社交参与的关键作用,为居家老年人远程体验提供个性化交互方案。

YH
Yaxin Hu et al.威斯康星大学麦迪逊分校

GenAssist:使图像生成更具可访问性

Huh 等人设计GenAssist系统,通过大语言模型生成视觉问题、视觉-语言模型提取答案,帮助盲人创作者验证AI生成图像是否符合提示词并比较候选图像,显著提升图像创作可访问性。

MH
Mina Huh et al.德克萨斯大学奥斯汀分校

幻灯片格式:用于非视觉访问的幻灯片演示中的自动结构提取

Peng 等人提出 Slide Gestalt 方法,通过计算幻灯片视觉和文本对应关系生成层级结构,帮助8名视障用户更高效导航幻灯片内容。

YP
Yi-Hao Peng et al.卡内基梅隆大学

现实裂隙:通过破坏感知因果关系创造奇妙界面

Cheng 等人提出现实裂隙概念,通过破坏感知因果关系创造奇妙界面,现场部署 50 人评估六特征原型,揭示激发用户惊奇感的设计要素。

LC
Lung-Pan Cheng et al.国立台湾大学

AVscript:使用音视频脚本进行可访问的视频编辑

Huh 等人开发 AVscript 基于文本的视频编辑器,通过嵌入视觉内容和语音的脚本帮助视力受损创作者编辑视频,降低精神需求并提升信心。

MH
Mina Huh et al.德克萨斯大学奥斯汀分校

WebUI:一个利用网络语义增强视觉UI理解的数据集

Wu 等人构建包含40万网页的WebUI数据集,利用网络语义增强视觉UI理解,在元素检测、屏幕分类和相似性任务上提升移动端模型性能。

JW
Jason Wu et al.卡内基梅隆大学

Diffscriber:描述视觉设计变化以支持混合能力协作演示文稿创作

Peng等人开发了Diffscriber系统,通过识别和描述幻灯片内容、布局和风格变化,帮助视障演示者与视力正常合作者进行高效的混合能力协作演示文稿创作。

YP
Yi-Hao Peng et al.卡内基梅隆大学

ImageExplorer: 多层触控探索以鼓励对不完美AI生成的图像字幕持怀疑态度

Lee 等人开发 ImageExplorer 多层触控系统,帮助盲人探索图像空间布局以判断AI生成标题准确性,12名盲人参与者成功增强对不完美标题的怀疑态度。

JL
Jaewook Lee et al.华盛顿大学

一言以蔽之:改进非视觉演示可访问性的反馈

Peng等人开发Presentation A11y系统,实时分析幻灯片视觉元素和口头演讲文本,使演讲者描述内容增加,演讲后可访问性问题识别率提升3.26倍

YP
Yi-Hao Peng et al.卡内基梅隆大学
论文标题作者研究主题论文库年份

StepWrite:用于语音驱动文本生成的适应性规划

Alaoui 等人提出 StepWrite 系统,通过上下文感知的非视觉音频提示引导用户进行结构化长文本语音撰写,显著降低认知负荷并提升移动场景下的写作效率。

HA
Hamza El Alaoui et al.卡内基梅隆大学

Morae:主动暂停UI代理以供用户选择

Peng 等人提出 Morae UI 代理系统,通过大模型自动识别决策点并暂停交互,使盲人用户能够参与选择过程,在真实网络任务中显著提升任务完成率和偏好匹配度。

YP
Yi-Hao Peng et al.卡内基梅隆大学

CodeA11y:使AI编码助手对可访问的网络开发有用

Mowar 等人开发CodeA11y扩展,解决AI编码助手忽略可访问性问题,通过提醒和代码建议指导新手开发人员,符合WCAG标准的Web UI代码。

PM
Peya Mowar et al.卡内基梅隆大学

UIClip:用于评估用户界面设计的数据驱动模型

Wu 等人提出UIClip数据驱动模型,通过大规模标注数据集训练可对UI截图进行质量评分和建议,在与12位设计师的评估中达到最高一致率。

JW
Jason Wu et al.卡内基梅隆大学
广告推荐

学习 AI 编程到 CodeNow

系统课程、实战项目、持续更新,适合想真正把 AI 用进开发流程的人。

立即查看open_in_new

"这让我们真的能看到整个世界:" 为居家老年人设计对话式远程临场机器人

Hu 等人设计了一款对话式远程临场机器人,通过需求发现和技术探测研究,识别出机器人引导探索与社交参与的关键作用,为居家老年人远程体验提供个性化交互方案。

YH
Yaxin Hu et al.威斯康星大学麦迪逊分校
emoji_events

GenAssist:使图像生成更具可访问性

Huh 等人设计GenAssist系统,通过大语言模型生成视觉问题、视觉-语言模型提取答案,帮助盲人创作者验证AI生成图像是否符合提示词并比较候选图像,显著提升图像创作可访问性。

MH
Mina Huh et al.德克萨斯大学奥斯汀分校

幻灯片格式:用于非视觉访问的幻灯片演示中的自动结构提取

Peng 等人提出 Slide Gestalt 方法,通过计算幻灯片视觉和文本对应关系生成层级结构,帮助8名视障用户更高效导航幻灯片内容。

YP
Yi-Hao Peng et al.卡内基梅隆大学

现实裂隙:通过破坏感知因果关系创造奇妙界面

Cheng 等人提出现实裂隙概念,通过破坏感知因果关系创造奇妙界面,现场部署 50 人评估六特征原型,揭示激发用户惊奇感的设计要素。

LC
Lung-Pan Cheng et al.国立台湾大学

AVscript:使用音视频脚本进行可访问的视频编辑

Huh 等人开发 AVscript 基于文本的视频编辑器,通过嵌入视觉内容和语音的脚本帮助视力受损创作者编辑视频,降低精神需求并提升信心。

MH
Mina Huh et al.德克萨斯大学奥斯汀分校
emoji_events

WebUI:一个利用网络语义增强视觉UI理解的数据集

Wu 等人构建包含40万网页的WebUI数据集,利用网络语义增强视觉UI理解,在元素检测、屏幕分类和相似性任务上提升移动端模型性能。

JW
Jason Wu et al.卡内基梅隆大学

Diffscriber:描述视觉设计变化以支持混合能力协作演示文稿创作

Peng等人开发了Diffscriber系统,通过识别和描述幻灯片内容、布局和风格变化,帮助视障演示者与视力正常合作者进行高效的混合能力协作演示文稿创作。

YP
Yi-Hao Peng et al.卡内基梅隆大学

ImageExplorer: 多层触控探索以鼓励对不完美AI生成的图像字幕持怀疑态度

Lee 等人开发 ImageExplorer 多层触控系统,帮助盲人探索图像空间布局以判断AI生成标题准确性,12名盲人参与者成功增强对不完美标题的怀疑态度。

JL
Jaewook Lee et al.华盛顿大学

一言以蔽之:改进非视觉演示可访问性的反馈

Peng等人开发Presentation A11y系统,实时分析幻灯片视觉元素和口头演讲文本,使演讲者描述内容增加,演讲后可访问性问题识别率提升3.26倍

YP
Yi-Hao Peng et al.卡内基梅隆大学