LAVE:LLM驱动的智能体辅助与语言增强视频编辑

大语言模型(LLM)的人机协作视频制作与编辑电影与动画制作人软件工程师与开发者

视频创作日益普及,但编辑所需的专业知识和努力往往对初学者构成障碍。在本文中,我们探索将大型语言模型集成到视频编辑工作流程中以降低这些障碍。我们的设计愿景体现在LAVE中,这是一个提供LLM驱动的智能体辅助和语言增强编辑功能的新颖系统。LAVE自动为用户的素材生成语言描述,作为使LLM处理视频并协助完成编辑任务的基础。当用户提供编辑目标时,智能体会规划并执行相关操作以完成任务。此外,LAVE允许用户通过智能体或直接UI操作编辑视频,提供灵活性并支持手动完善智能体的操作。我们对八名从新手到熟练编辑者的用户进行的研究表明了LAVE的有效性。结果还揭示了用户对所提出的LLM辅助编辑范式的看法及其对用户创造力和共同创造感的影响。基于这些发现,我们提出了设计建议,以指导智能体辅助内容编辑的未来开发。

快捷操作

分享

分享当前页面

ios_share

https://hci.top/zh/papers/iui/139215/2024

广告推荐

学习 AI 编程到 CodeNow

一眼看懂

论文快照

fact_check
dataset
来源
IUI
calendar_month
年份
2024
emoji_events
奖项
未标记奖项
group
作者
6 位作者
sell
研究子方向
大语言模型(LLM)的人机协作、视频制作与编辑
work
职业/产业
电影与动画制作人、软件工程师与开发者
article
内容状态
仅摘要
hub
相关论文
0 篇相关论文