从文本到像素:通过文本到图像模型解释增强用户理解

生成式AI(文本、图像、音乐、视频)可解释人工智能(XAI)UI/UX 设计师HCI 研究员Amazon Mechanical Turk 工作者

文本到图像(T2I)模型的最新进展为艺术、设计、教育、医学和娱乐领域带来了变革性应用前景。然而,这些模型对许多用户而言仍是“黑箱”运作。本研究通过开发并评估针对缺乏经验的终端用户的T2I模型解释技术来弥合这一差距。我们通过与专家的形成性研究确定了独特的解释目标,并设计了定制化解释策略。随后,我们通过473名Amazon Mechanical Turk参与者在三项任务中进行了实证评估。研究结果突出了用户通过解释学习新关键词的能力、对示例化解释的偏好,以及在理解显著改变图像主题的解释时面临的挑战。此外,研究发现用户从有限数量的并发解释中受益。我们的主要贡献包括:用于评估T2I可解释性技术的数据集、AMT用户研究的见解,以及对未来T2I模型可解释性研究至关重要的观察。

快捷操作

分享

分享当前页面

ios_share

https://hci.top/zh/papers/iui/139207/2024

广告推荐

学习 AI 编程到 CodeNow

一眼看懂

论文快照

fact_check
dataset
来源
IUI
calendar_month
年份
2024
emoji_events
奖项
未标记奖项
group
作者
3 位作者
sell
研究子方向
生成式AI(文本、图像、音乐、视频)、可解释人工智能(XAI)
work
职业/产业
UI/UX 设计师、HCI 研究员、Amazon Mechanical Turk 工作者
article
内容状态
仅摘要
hub
相关论文
3 篇相关论文