利用视觉增强对话代理提升互动艺术展览的访客参与度

会话代理的人格与拟人化VR 中的社交与协作博物馆与文化遗产数字化博物馆馆员与策展人

艺术展览中的对话代理可以通过提供上下文信息(尤其是语音交互)来增强用户参与度和艺术品理解。然而,与艺术建立更深层的个人联系——这通常需要直接的美学和视觉体验——仍然是一个挑战。本文研究了将视觉感知整合到对话代理中如何增强与访客艺术诠释的对齐,从而促进与互动艺术展览的更深层参与。我们介绍了一款通过多模态大语言模型(MLLM)增强的语音对话代理,使代理能够实时感知并与访客讨论艺术品。该系统采用简化的检索增强生成(RAG)架构,收集语音输入,从领域知识图中检索相关信息,并使用 LLM 生成对话响应,然后转换为语音输出。我们对 36 名参与者进行了用户研究,分为两组,以比较增强系统与缺乏视觉输入的基线系统。结果表明,视觉增强系统显著提升了访客参与度和满意度。对话记录的内容分析进一步揭示了更广泛的对话主题、更深入的访客感知,以及代理提供更细致入微的、与视觉相关讨论的能力。

快捷操作

分享

分享当前页面

ios_share

https://hci.top/zh/papers/iui/195828/2025

广告推荐

学习 AI 编程到 CodeNow

open_in_new打开DOI链接
DOI: https://doi.org/10.1145/3708359.3712145
一眼看懂

论文快照

fact_check
dataset
来源
IUI
calendar_month
年份
2025
emoji_events
奖项
未标记奖项
group
作者
5 位作者
sell
研究子方向
会话代理的人格与拟人化、VR 中的社交与协作、博物馆与文化遗产数字化
work
职业/产业
博物馆馆员与策展人
article
内容状态
仅摘要
hub
相关论文
0 篇相关论文