DesignMinds:利用视觉语言模型和上下文注入的大语言模型增强视频设计构思
生成式AI(文本、图像、音乐、视频)大语言模型(LLM)的人机协作平面设计与排版工具UI/UX 设计师产品设计师
构思是视频设计(VBD)的关键环节,其中视频作为设计探索和灵感的主要媒介。生成式人工智能的出现为通过简化视频分析和促进创意生成来增强这一过程提供了相当大的潜力。本文提出了DesignMinds,一个集成了先进的视觉语言模型(VLM)与上下文增强的大语言模型(LLM)的原型系统,以支持视频设计中的构思活动。为了评估DesignMinds,我们对35名设计从业者进行了被试间研究,将其性能与基线条件进行比较。我们的结果表明,DesignMinds显著增强了构思的灵活性和原创性,同时提高了任务参与度。重要的是,该技术的引入未对用户体验、技术接受度或可用性产生负面影响。
研究问题 / 现实痛点
这篇论文在当前问题库中对应的问题线索。
当前问题库还没有收录这篇论文的问题与痛点。
- 100%
ICONATE:自动复合图标生成与构思
CHI '20· 生成式AI(文本、图像、音乐、视频) +2
- 100%
"可塑的黏土":用户体验与工业设计实践中的生成式人工智能工具
DIS '24· 生成式AI(文本、图像、音乐、视频) +2
- 80%
探索支持设计师学习与基于AI的制造设计工具协同创造的挑战与机遇
CHI '23· 生成式AI(文本、图像、音乐、视频) +1
- 80%
从少量示例中学习个人风格
DIS '21· 生成式AI(文本、图像、音乐、视频) +1
- 80%
与人工智能设计构思——生成式机器学习模型的素描、思考与对话
DIS '23· 生成式AI(文本、图像、音乐、视频) +1
- 67%
Vinci:一款用于生成广告海报的智能图形设计系统
CHI '21· 生成式AI(文本、图像、音乐、视频) +1
- 67%
StyleMe:迈向具有设计师风格的智能时尚生成
CHI '23· 生成式AI(文本、图像、音乐、视频) +1
- 67%
Jigsaw:通过连接AI基础模型支持设计师原型设计多模态应用程序
CHI '24· 生成式AI(文本、图像、音乐、视频) +2
- 67%
CreativeConnect: 利用生成式人工智能支持图形设计构思中的参考重组
CHI '24· 生成式AI(文本、图像、音乐、视频) +2
- 67%
在约束下创意舞蹈:UI/UX设计中使用UIDEC进行创意构思
CHI '25· 360° 视频与全景内容 +2
基于研究子主题与职业分类的 Jaccard 相似度(≥60%)
快捷操作
广告推荐
学习 AI 编程到 CodeNow
open_in_new打开DOI链接
DOI: https://doi.org/10.1145/3719160.3736633
一眼看懂
fact_check论文快照
dataset
来源
CUI
calendar_month
年份
2025
emoji_events
奖项
未标记奖项
group
作者
4 位作者
sell
研究子方向
生成式AI(文本、图像、音乐、视频)、大语言模型(LLM)的人机协作、平面设计与排版工具
work
职业/产业
UI/UX 设计师、产品设计师
article
内容状态
仅摘要
hub
相关论文
10 篇相关论文