ImaginationVellum:带空间提示、生成笔触和构思历史的生成式AI构思画布
荣誉提名作者
我们介绍了ImaginationVellum,一个用于早期视觉构思和概念草图生成的多模态空间画布。该系统支持一种独特的人-AI协作风格,即画布就是提示词。这意味着ImaginationVellum将整个2D画布作为主动提示空间,其中空间排列、邻近性和多元内容元素——墨迹、文本、图像和中间结果——的组合引导生成视觉结果。作为技术探索,ImaginationVellum贡献了一套基于空间的直接操作工具,用于迭代视觉构思。特别是,我们引入了生成笔触——自由形态的笔触,在多个潜在语义或风格维度上空间调节生成和提示词参数。这些技术通过概念收敛、分化、重新组合、混合和混合实现设计空间的快速遍历。我们详细介绍了系统架构、设计原理、用于局部控制的空间依赖意图标签、空间提示方法以及沿空间梯度变化输出的方法。时间和起源的可视化回放使构思轨迹可操作,将设计过程本身转化为支持行动中反思和设计决策重新访问的产物。我们报告了关于用户如何使用空间提示构建、引导和重新访问想法的初步研究见解,并讨论了空间依赖内容生成中的权衡。
研究问题 / 现实痛点
这篇论文在当前问题库中对应的问题线索。
- 100%
“我不想感觉自己在60年代的工厂工作”:从业者对创意支持工具采用的看法
CHI '22· 生成式AI(文本、图像、音乐、视频) +1
- 100%
GANCollage:一种GAN驱动的数字情绪板以支持创意构思
DIS '23· 生成式AI(文本、图像、音乐、视频) +1
- 83%
FashionQ:一种促进时尚设计创意构思的人工智能驱动支持工具
CHI '21· 生成式AI(文本、图像、音乐、视频) +2
- 83%
利用生成式AI打造创意专长:图形界面在设计空间探索中比文本提示更好地支持创意构思
CHI '24· 生成式AI(文本、图像、音乐、视频) +2
- 83%
探索用于抽象驱动的探索性图像着色的交互式颜色调板
CHI '24· 生成式AI(文本、图像、音乐、视频) +2
- 83%
GenPara: 通过使用文本条件形状参数推断用户感兴趣区域来增强3D设计编辑过程
CHI '25· 生成式AI(文本、图像、音乐、视频) +2
- 83%
DesignPrompt:利用多模态交互进行生成式AI设计探索
DIS '24· 生成式AI(文本、图像、音乐、视频) +2
- 80%
GANravel: 在生成对抗网络中用户驱动的方向解缠
CHI '23· 生成式AI(文本、图像、音乐、视频) +1
- 80%
用人工智能进行图像制作的创意反思:与一款挑衅性的‘相机’的互动
CHI '25· 生成式AI(文本、图像、音乐、视频) +1
- 80%
探索最优组合:设计概念中顺序多模态激励刺激对创造力的影响
DIS '24· 生成式AI(文本、图像、音乐、视频) +1
基于研究子主题与职业分类的 Jaccard 相似度(≥60%)