生成式转描:生成式视频到视频实践的自我回顾式探索
作者
生成式AI(文本、图像、音乐、视频)视频制作与编辑内容创作者(YouTuber、Podcaster)电影与动画制作人
本文贡献了一项关于AI视频到视频技术的自我回顾式探索,我称之为「生成式转描」。这包括:关于创作过程的洞见、一系列原型探索以及多模态视频生成的综合工作流。生成式视频正在快速发展并提供更高质量的输出。虽然视频生成模型在电影制作和内容创作方面具有潜力,但它们缺乏创意表达的可控性:可行的视频可能需要数百次不成功的尝试。为了理解这种新兴实践,由于模型的不断演进和早期采用者数量有限,我在12个月内探索了生成式转描,创建了AI工作流,产生了超过40,000个视频/图像文件,研究了包括结构引导、帧一致性、图像引用和遮罩、合成等多种模型和技术。这项工作的洞见可作为设计下一代视频创作工具的起点。
研究问题 / 现实痛点
这篇论文在当前问题库中对应的问题线索。
当前问题库还没有收录这篇论文的问题与痛点。
- 75%
使用最常重播的数据生成用户指定长度的精彩视频
CHI '25· 视频制作与编辑
- 67%
Vidmento:基于生成式视频的脚手架式扩展视频故事创作工具
CHI '26· 生成式AI(文本、图像、音乐、视频) +2
- 67%
重写视频:文本驱动的视频素材重创作
IUI '26· 生成式AI(文本、图像、音乐、视频) +2
- 60%
B-Script:基于剧本的B卷视频编辑及推荐
CHI '19· 推荐系统用户体验 +1
- 60%
理解在广播系统中部署基于AI的内容创作支持工具的动态 - 优势、挑战和方向
CHI '25· 生成式AI(文本、图像、音乐、视频) +1
- 60%
XCam:用于虚拟现实体验现场制作的混合发起虚拟摄像
CHI '25· VR 中的社交与协作 +1
- 60%
Videogenic:利用专业照片作为先验信息识别视频中的高光时刻
C&C '24· 生成式AI(文本、图像、音乐、视频) +1
基于研究子主题与职业分类的 Jaccard 相似度(≥60%)
快捷操作
一眼看懂
fact_check论文快照
dataset
来源
C&C
calendar_month
年份
2025
emoji_events
奖项
未标记奖项
group
作者
1 位作者
sell
研究子方向
生成式AI(文本、图像、音乐、视频)、视频制作与编辑
work
职业/产业
内容创作者(YouTuber、Podcaster)、电影与动画制作人
article
内容状态
仅摘要
hub
相关论文
7 篇相关论文