Visual Lyrics:使用增强文本编辑器为音乐歌词视频生成动画文本Lin 等人提出 Visual Lyrics 系统,利用多模态音乐分析和 LLM 生成能力,通过增强文本编辑器帮助新手轻松创建高质量动画歌词视频。2026DLDavid Chuan-En Lin et al.卡内基梅隆大学AI 辅助创意写作视频制作与编辑创意协作与反馈系统IUI
VideoDiff:人类与AI的视频协同创作及其替代方案Huh 等人开发 VideoDiff 视频编辑工具,通过时间线和预览支持多 AI 建议生成与比较,12 名用户参与评估,显著提升编辑定制效率。2025MHMina Huh et al.德克萨斯大学奥斯汀分校生成式AI(文本、图像、音乐、视频)视频制作与编辑创意协作与反馈系统CHI
组合结构作为人机协同创作环境的基底:一种设计方法和案例研究Cao 等人提出以组合结构为基础的视频共同创作环境设计方法,使用户能在创作中保持方向感并有效控制AI生成内容,实现灵活人机协作。2025YCYining Cao et al.加州大学圣迭戈分校生成式AI(文本、图像、音乐、视频)创意协作与反馈系统CHI
音乐视频到歌词视频的自动化转换Ma 等人提出歌词视频自动生成管道,基于设计指南实现文本可读性与注意力统一,生成的歌词视频在用户研究中验证了有效性。2023JMJiaju Ma et al.斯坦福大学音乐创作与声音设计工具视频制作与编辑UIST
CatchLive:结合流内容和交互数据的实时流摘要Yang等人开发CatchLive系统,利用直播内容和交互数据提供实时摘要和多级高光时刻,帮助观众了解直播概览并保持参与度2022SYSaelyne Yang et al.韩国科学技术院直播与观赛体验(Streaming)流媒体与内容创作者CHI
SymbolFinder:利用本地语义网络头脑风暴多样化符号Petridis 等人开发 SymbolFinder,通过语义网络词簇帮助设计师头脑风暴抽象概念的多样化视觉符号2021SPSavvas Petridis et al.哥伦比亚大学数据故事讲述(Data Storytelling)平面设计与排版工具UIST
超越举手之劳:通过表达性和可扩展的视觉通信在直播中吸引观众Chung 等人设计 VisPoll 系统及其 VIMF 框架,帮助主播指定、汇总和可视化大量视觉输入,初步评估表明该系统可扩展直播观众互动的表达性和类型2021JCJohn Joon Young Chung et al.Midjourney直播与观赛体验(Streaming)社交平台设计与用户行为CHI
创意直播的时间分割Fraser 等人提出结合音频转录和软件使用日志的自动时间分割方法,能够将数小时创意直播分割为可标记段落,与观众分割效果相似。2020CFC. Ailie Fraser et al.加利福尼亚大学流媒体与内容创作者创意协作与反馈系统CHI
快照流:基于快照的视觉艺术直播互动Yang等人开发Snapstream系统,允许用户拍摄直播快照并注释分享,主播可口头引用快照回应,研究表明该方式显著提升了视觉艺术直播的交流生动性和清晰度。2020SYSaelyne Yang et al.韩国科学技术院流媒体与内容创作者平面设计与排版工具CHI
使用词具体性从文本文章生成音频视觉幻灯片Leake等人提出基于单词具体性的系统,将文本自动转换为视听幻灯片,选择具体性高的词搜索相关图片并与TTS音频时间对齐,用户评估表明该方法质量与手动制作相当,显著优于简单关键词搜索。2020MLMackenzie Leake et al.麻省理工学院生成式AI(文本、图像、音乐、视频)数据故事讲述(Data Storytelling)CHI
B-Script:基于剧本的B卷视频编辑及推荐Huber等人设计B-Script系统,通过交互式文本记录和基于专家标注训练的推荐系统辅助B-roll视频编辑,用户研究证实在110名参与者中编辑效率显著提升2019BHBernd Huber et al.哈佛大学推荐系统用户体验视频制作与编辑CHI