StyleFactory:通过风格强度控制与评估实现图像创作中更好的风格对齐
作者
生成式AI(文本、图像、音乐、视频)AI 辅助创意写作创意协作与反馈系统UI/UX 设计师视觉艺术家与设计师自由职业者(设计、写作、翻译)
生成式AI模型已广泛用于图像创作。然而,由于人与模型之间风格表达和理解较差,生成与用户个人审美风格(如颜色和纹理)良好对齐的图像具有挑战性。通过一项形成性研究,我们观察到参与者对所需风格及其强度变化有明确的主观感知,这启示我们开发基于风格强度的控制和评估方法。基于此,我们提出StyleFactory,一个帮助用户实现风格对齐的交互式系统。该界面使用户能够根据所需风格的强度对图像进行排名,并从模型视角可视化该风格下其他图像的强度分布。通过这种方式,用户可以评估自身与模型之间的理解差距,并通过针对性迭代定义对齐良好的个人创作风格。我们的技术评估和用户研究表明,StyleFactory能够准确生成特定风格的图像,有效促进图像创作工作流程中的风格对齐,刺激创造力,并增强人-AI交互中的用户体验。
研究问题 / 现实痛点
这篇论文在当前问题库中对应的问题线索。
当前问题库还没有收录这篇论文的问题与痛点。
- 100%
Sketchforme:用于交互式应用的基于文本描述生成草图场景
UIST '19· 生成式AI(文本、图像、音乐、视频) +2
- 83%
文本到图像实践社区研究:人们如何及为何提示生成式AI
C&C '23· 生成式AI(文本、图像、音乐、视频) +1
- 67%
FlatMagic:通过AI驱动的设计改进数字漫画专业人士的平涂上色
CHI '22· 生成式AI(文本、图像、音乐、视频) +1
- 67%
GANravel: 在生成对抗网络中用户驱动的方向解缠
CHI '23· 生成式AI(文本、图像、音乐、视频) +1
- 67%
Artinter: 委托视觉艺术的人工智能驱动边界对象
DIS '23· 生成式AI(文本、图像、音乐、视频) +1
- 67%
工具何时为工具?用户对人-AI协同创作绘画中系统代理性的感知
DIS '23· 生成式AI(文本、图像、音乐、视频) +1
- 67%
PromptPaint:通过类似绘画媒介的交互引导文本到图像生成
UIST '23· 生成式AI(文本、图像、音乐、视频) +1
- 67%
DrawTalking:通过手绘与语音构建交互式世界
UIST '24· AI 辅助创意写作 +1
基于研究子主题与职业分类的 Jaccard 相似度(≥60%)
快捷操作
广告推荐
学习 AI 编程到 CodeNow
open_in_new打开DOI链接
DOI: https://doi.org/10.1145/3654777.3676370
一眼看懂
fact_check论文快照
dataset
来源
UIST
calendar_month
年份
2024
emoji_events
奖项
未标记奖项
group
作者
9 位作者
sell
研究子方向
生成式AI(文本、图像、音乐、视频)、AI 辅助创意写作、创意协作与反馈系统
work
职业/产业
UI/UX 设计师、视觉艺术家与设计师、自由职业者(设计、写作、翻译)
article
内容状态
仅摘要
hub
相关论文
8 篇相关论文