HCI.TOPHCI, made easy
首页arXiv论文机构作者设计规范问题知识卡创新日程
首页arXiv论文机构作者设计规范问题知识卡创新日程
学习AI编程数据说明HCI 会议HCI 论文关于薛志荣
search
当前筛选
search
全部

论文

浏览与搜索 全部 的 HCI 研究论文

当前筛选
作者: 3785
共 11 条

Visual Lyrics:使用增强文本编辑器为音乐歌词视频生成动画文本

Lin 等人提出 Visual Lyrics 系统,利用多模态音乐分析和 LLM 生成能力,通过增强文本编辑器帮助新手轻松创建高质量动画歌词视频。

DL
David Chuan-En Lin et al.卡内基梅隆大学

VideoDiff:人类与AI的视频协同创作及其替代方案

Huh 等人开发 VideoDiff 视频编辑工具,通过时间线和预览支持多 AI 建议生成与比较,12 名用户参与评估,显著提升编辑定制效率。

MH
Mina Huh et al.德克萨斯大学奥斯汀分校

组合结构作为人机协同创作环境的基底:一种设计方法和案例研究

Cao 等人提出以组合结构为基础的视频共同创作环境设计方法,使用户能在创作中保持方向感并有效控制AI生成内容,实现灵活人机协作。

YC
Yining Cao et al.加州大学圣迭戈分校

音乐视频到歌词视频的自动化转换

Ma 等人提出歌词视频自动生成管道,基于设计指南实现文本可读性与注意力统一,生成的歌词视频在用户研究中验证了有效性。

JM
Jiaju Ma et al.斯坦福大学
广告推荐

学习 AI 编程到 CodeNow

系统课程、实战项目、持续更新,适合想真正把 AI 用进开发流程的人。

立即查看open_in_new

CatchLive:结合流内容和交互数据的实时流摘要

Yang等人开发CatchLive系统,利用直播内容和交互数据提供实时摘要和多级高光时刻,帮助观众了解直播概览并保持参与度

SY
Saelyne Yang et al.韩国科学技术院

SymbolFinder:利用本地语义网络头脑风暴多样化符号

Petridis 等人开发 SymbolFinder,通过语义网络词簇帮助设计师头脑风暴抽象概念的多样化视觉符号

SP
Savvas Petridis et al.哥伦比亚大学

超越举手之劳:通过表达性和可扩展的视觉通信在直播中吸引观众

Chung 等人设计 VisPoll 系统及其 VIMF 框架,帮助主播指定、汇总和可视化大量视觉输入,初步评估表明该系统可扩展直播观众互动的表达性和类型

JC
John Joon Young Chung et al.Midjourney

创意直播的时间分割

Fraser 等人提出结合音频转录和软件使用日志的自动时间分割方法,能够将数小时创意直播分割为可标记段落,与观众分割效果相似。

CF
C. Ailie Fraser et al.加利福尼亚大学

快照流:基于快照的视觉艺术直播互动

Yang等人开发Snapstream系统,允许用户拍摄直播快照并注释分享,主播可口头引用快照回应,研究表明该方式显著提升了视觉艺术直播的交流生动性和清晰度。

SY
Saelyne Yang et al.韩国科学技术院

使用词具体性从文本文章生成音频视觉幻灯片

Leake等人提出基于单词具体性的系统,将文本自动转换为视听幻灯片,选择具体性高的词搜索相关图片并与TTS音频时间对齐,用户评估表明该方法质量与手动制作相当,显著优于简单关键词搜索。

ML
Mackenzie Leake et al.麻省理工学院

B-Script:基于剧本的B卷视频编辑及推荐

Huber等人设计B-Script系统,通过交互式文本记录和基于专家标注训练的推荐系统辅助B-roll视频编辑,用户研究证实在110名参与者中编辑效率显著提升

BH
Bernd Huber et al.哈佛大学
论文标题作者研究主题论文库年份

Visual Lyrics:使用增强文本编辑器为音乐歌词视频生成动画文本

Lin 等人提出 Visual Lyrics 系统,利用多模态音乐分析和 LLM 生成能力,通过增强文本编辑器帮助新手轻松创建高质量动画歌词视频。

DL
David Chuan-En Lin et al.卡内基梅隆大学

VideoDiff:人类与AI的视频协同创作及其替代方案

Huh 等人开发 VideoDiff 视频编辑工具,通过时间线和预览支持多 AI 建议生成与比较,12 名用户参与评估,显著提升编辑定制效率。

MH
Mina Huh et al.德克萨斯大学奥斯汀分校

组合结构作为人机协同创作环境的基底:一种设计方法和案例研究

Cao 等人提出以组合结构为基础的视频共同创作环境设计方法,使用户能在创作中保持方向感并有效控制AI生成内容,实现灵活人机协作。

YC
Yining Cao et al.加州大学圣迭戈分校

音乐视频到歌词视频的自动化转换

Ma 等人提出歌词视频自动生成管道,基于设计指南实现文本可读性与注意力统一,生成的歌词视频在用户研究中验证了有效性。

JM
Jiaju Ma et al.斯坦福大学
广告推荐

学习 AI 编程到 CodeNow

系统课程、实战项目、持续更新,适合想真正把 AI 用进开发流程的人。

立即查看open_in_new

CatchLive:结合流内容和交互数据的实时流摘要

Yang等人开发CatchLive系统,利用直播内容和交互数据提供实时摘要和多级高光时刻,帮助观众了解直播概览并保持参与度

SY
Saelyne Yang et al.韩国科学技术院

SymbolFinder:利用本地语义网络头脑风暴多样化符号

Petridis 等人开发 SymbolFinder,通过语义网络词簇帮助设计师头脑风暴抽象概念的多样化视觉符号

SP
Savvas Petridis et al.哥伦比亚大学

超越举手之劳:通过表达性和可扩展的视觉通信在直播中吸引观众

Chung 等人设计 VisPoll 系统及其 VIMF 框架,帮助主播指定、汇总和可视化大量视觉输入,初步评估表明该系统可扩展直播观众互动的表达性和类型

JC
John Joon Young Chung et al.Midjourney

创意直播的时间分割

Fraser 等人提出结合音频转录和软件使用日志的自动时间分割方法,能够将数小时创意直播分割为可标记段落,与观众分割效果相似。

CF
C. Ailie Fraser et al.加利福尼亚大学

快照流:基于快照的视觉艺术直播互动

Yang等人开发Snapstream系统,允许用户拍摄直播快照并注释分享,主播可口头引用快照回应,研究表明该方式显著提升了视觉艺术直播的交流生动性和清晰度。

SY
Saelyne Yang et al.韩国科学技术院

使用词具体性从文本文章生成音频视觉幻灯片

Leake等人提出基于单词具体性的系统,将文本自动转换为视听幻灯片,选择具体性高的词搜索相关图片并与TTS音频时间对齐,用户评估表明该方法质量与手动制作相当,显著优于简单关键词搜索。

ML
Mackenzie Leake et al.麻省理工学院

B-Script:基于剧本的B卷视频编辑及推荐

Huber等人设计B-Script系统,通过交互式文本记录和基于专家标注训练的推荐系统辅助B-roll视频编辑,用户研究证实在110名参与者中编辑效率显著提升

BH
Bernd Huber et al.哈佛大学