FuzzySeek:用于时刻检索的模糊视频查询多模态优化

探索式搜索与信息探寻知识图谱与语义搜索物理-数字混合交互软件工程师与开发者UI/UX 设计师HCI 研究员

最近的人工智能进展使得使用自然语言查询从长视频中检索特定时刻成为可能。然而,现有系统可能难以将检索结果与用户意图对齐,因为缺乏用户用简单自然语言表达意图的手段。此外,在交互式帮助用户表达或完善意图方面支持有限。我们提出FuzzySeek,这是一种视频时刻检索界面,通过多模态交互支持模糊或广泛探索性查询的表达和指定。FuzzySeek提出三个关键组件:(1)多模态混合文本查询,以提高表达力,使用户能够在其文本查询中直接锚定多模态内容;(2)主动多模态指导,识别模糊/广泛的术语和短语,并在各模态中展示有针对性的澄清,以提高查询特异性;以及(3)查询回滚,实现迭代来回探索,以启用直接或探索性搜索。通过技术评估、多个说明性用例和一项有11名参与者的用户研究,我们表明FuzzySeek提高了澄清效率,减少了认知负荷,并与不支持此类支持的基线系统相比,为模糊查询提供了更好的视频时刻检索支持。

快捷操作

分享

分享当前页面

ios_share

https://hci.top/zh/papers/iui/226595/2026

广告推荐

学习 AI 编程到 CodeNow

一眼看懂

论文快照

fact_check
dataset
来源
IUI
calendar_month
年份
2026
emoji_events
奖项
未标记奖项
group
作者
3 位作者
sell
研究子方向
探索式搜索与信息探寻、知识图谱与语义搜索、物理-数字混合交互
work
职业/产业
软件工程师与开发者、UI/UX 设计师、HCI 研究员
article
内容状态
仅摘要
hub
相关论文
0 篇相关论文