POET: 支持文本到图像生成的提示创意与个性化自动化扩展

生成式AI(文本、图像、音乐、视频)AI 辅助创意写作音乐人、DJ 与声音设计师电影与动画制作人软件工程师与开发者UI/UX 设计师视觉艺术家与设计师

最先进的视觉生成式AI工具在创意任务早期构思阶段具有巨大潜力,能够生成新颖独特的高质量图像以满足用户的多样化规范组合。然而,许多大规模文本到图像系统设计用于广泛适用性,产生的传统输出可能限制创意探索,且交互方法对初学者而言难以使用。由于创意用户的工作方式多样且不可预测,需要更多变化和个性化。我们引入POET实时交互工具,能够(1)自动发现文本到图像模型中的同质性维度,(2)扩展这些维度以多样化生成图像的输出空间,(3)学习用户反馈以实现个性化扩展。对28名用户跨越四个创意任务领域的评估表明,POET能够生成感知多样性更高的结果,帮助用户在更少提示下达到满意,促使他们在协作创作过程中对更广泛的可能结果进行更多思考和反思。聚焦于视觉创造力,POET首次展示了未来文本到图像生成工具的交互技术如何支持和符合更多多元化价值观及用户构思阶段的需求。

快捷操作

分享

分享当前页面

ios_share

https://hci.top/zh/papers/uist/206839/2025

广告推荐

学习 AI 编程到 CodeNow

open_in_new打开DOI链接
DOI: https://doi.org/10.1145/3746059.3747710
一眼看懂

论文快照

fact_check
dataset
来源
UIST
calendar_month
年份
2025
emoji_events
奖项
未标记奖项
group
作者
6 位作者
sell
研究子方向
生成式AI(文本、图像、音乐、视频)、AI 辅助创意写作
work
职业/产业
音乐人、DJ 与声音设计师、电影与动画制作人、软件工程师与开发者、UI/UX 设计师
article
内容状态
仅摘要
hub
相关论文
5 篇相关论文