POET: 支持文本到图像生成的提示创意与个性化自动化扩展
作者
生成式AI(文本、图像、音乐、视频)AI 辅助创意写作音乐人、DJ 与声音设计师电影与动画制作人软件工程师与开发者UI/UX 设计师视觉艺术家与设计师
最先进的视觉生成式AI工具在创意任务早期构思阶段具有巨大潜力,能够生成新颖独特的高质量图像以满足用户的多样化规范组合。然而,许多大规模文本到图像系统设计用于广泛适用性,产生的传统输出可能限制创意探索,且交互方法对初学者而言难以使用。由于创意用户的工作方式多样且不可预测,需要更多变化和个性化。我们引入POET实时交互工具,能够(1)自动发现文本到图像模型中的同质性维度,(2)扩展这些维度以多样化生成图像的输出空间,(3)学习用户反馈以实现个性化扩展。对28名用户跨越四个创意任务领域的评估表明,POET能够生成感知多样性更高的结果,帮助用户在更少提示下达到满意,促使他们在协作创作过程中对更广泛的可能结果进行更多思考和反思。聚焦于视觉创造力,POET首次展示了未来文本到图像生成工具的交互技术如何支持和符合更多多元化价值观及用户构思阶段的需求。
研究问题 / 现实痛点
这篇论文在当前问题库中对应的问题线索。
当前问题库还没有收录这篇论文的问题与痛点。
- 63%
启发式发现:使用Dreamsheets为AI艺术创作进行灵活的意义构建
CHI '24· 生成式AI(文本、图像、音乐、视频) +2
- 63%
PromptCharm: 通过多模态提示和优化的文本到图像生成
CHI '24· 生成式AI(文本、图像、音乐、视频) +2
- 63%
AI构思:设计一个人工智能与人协作的构思系统给概念设计师
CHI '25· 大语言模型(LLM)的人机协作 +1
- 63%
改进AI生成艺术中的主体表现:使用图像提示与文本到图像生成模型的设计指南
C&C '22· 生成式AI(文本、图像、音乐、视频) +2
- 63%
Crosspower:连接图形与语言
UIST '20· 生成式AI(文本、图像、音乐、视频) +2
基于研究子主题与职业分类的 Jaccard 相似度(≥60%)
快捷操作
广告推荐
学习 AI 编程到 CodeNow
open_in_new打开DOI链接
DOI: https://doi.org/10.1145/3746059.3747710
一眼看懂
fact_check论文快照
dataset
来源
UIST
calendar_month
年份
2025
emoji_events
奖项
未标记奖项
group
作者
6 位作者
sell
研究子方向
生成式AI(文本、图像、音乐、视频)、AI 辅助创意写作
work
职业/产业
音乐人、DJ 与声音设计师、电影与动画制作人、软件工程师与开发者、UI/UX 设计师
article
内容状态
仅摘要
hub
相关论文
5 篇相关论文