DesignMinds:利用视觉语言模型和上下文注入的大语言模型增强视频设计构思

生成式AI(文本、图像、音乐、视频)大语言模型(LLM)的人机协作平面设计与排版工具UI/UX 设计师产品设计师

构思是视频设计(VBD)的关键环节,其中视频作为设计探索和灵感的主要媒介。生成式人工智能的出现为通过简化视频分析和促进创意生成来增强这一过程提供了相当大的潜力。本文提出了DesignMinds,一个集成了先进的视觉语言模型(VLM)与上下文增强的大语言模型(LLM)的原型系统,以支持视频设计中的构思活动。为了评估DesignMinds,我们对35名设计从业者进行了被试间研究,将其性能与基线条件进行比较。我们的结果表明,DesignMinds显著增强了构思的灵活性和原创性,同时提高了任务参与度。重要的是,该技术的引入未对用户体验、技术接受度或可用性产生负面影响。

快捷操作

分享

分享当前页面

ios_share

https://hci.top/zh/papers/cui/204405/2025

广告推荐

学习 AI 编程到 CodeNow

open_in_new打开DOI链接
DOI: https://doi.org/10.1145/3719160.3736633
一眼看懂

论文快照

fact_check
dataset
来源
CUI
calendar_month
年份
2025
emoji_events
奖项
未标记奖项
group
作者
4 位作者
sell
研究子方向
生成式AI(文本、图像、音乐、视频)、大语言模型(LLM)的人机协作、平面设计与排版工具
work
职业/产业
UI/UX 设计师、产品设计师
article
内容状态
仅摘要
hub
相关论文
10 篇相关论文