BloomIntent:使用LLM生成的细粒度用户意图自动化搜索评估

大语言模型(LLM)的人机协作可解释人工智能(XAI)推荐系统用户体验时序数据与网络图可视化数据科学家与分析师AI/ML 研究员与工程师HCI 研究员

如果100个人发出相同的搜索查询,他们可能有100个不同的目标。虽然现有以用户为中心的AI评估工作强调将系统与细粒度用户意图对齐的重要性,但当前搜索评估方法难以表示和评估这种多样性。我们引入了BloomIntent,这是一种以用户为中心的搜索评估方法,使用用户意图作为评估单元。BloomIntent首先基于用户属性和信息寻求意图类型的分类法生成一组看似合理的细粒度搜索意图。然后,BloomIntent提供由大型语言模型驱动的针对每个意图的搜索结果自动化评估。为支持实际分析,BloomIntent对语义相似的意图进行聚类,并在结构化界面中总结评估结果。通过三项技术评估,我们表明BloomIntent生成了细粒度、可评估且现实的意图,并产生了可扩展的意图级满意度评估,与专家评估者达成72%的一致性。在案例研究(N=4)中,我们展示了BloomIntent帮助搜索专家识别模糊查询的意图,发现未满足的用户需求,并发现改善搜索体验的可操作见解。通过从查询级转向意图级评估,BloomIntent重新構想了搜索系统的评估方式——不仅评估性能,还评估其服务众多用户目标的能力。

快捷操作

分享

分享当前页面

ios_share

https://hci.top/zh/papers/uist/206903/2025

广告推荐

学习 AI 编程到 CodeNow

open_in_new打开DOI链接
DOI: https://doi.org/10.1145/3746059.3747677
一眼看懂

论文快照

fact_check
dataset
来源
UIST
calendar_month
年份
2025
emoji_events
奖项
未标记奖项
group
作者
7 位作者
sell
研究子方向
大语言模型(LLM)的人机协作、可解释人工智能(XAI)、推荐系统用户体验、时序数据与网络图可视化
work
职业/产业
数据科学家与分析师、AI/ML 研究员与工程师、HCI 研究员
article
内容状态
仅摘要
hub
相关论文
8 篇相关论文