CGAT-Net: 用于场景草图识别的上下文感知图注意力Transformer网络

交互式数据可视化计算方法在HCI中的应用软件工程师与开发者UI/UX 设计师AI/ML 研究员与工程师

草图通常缺乏独立识别所需的足够细节或质量,使得在没有上下文信息的情况下识别具有挑战性。虽然上下文理解在计算机视觉应用如目标检测或图像分类中已得到广泛研究,但在草图领域仍然未被充分探索。现有研究主要关注独立识别草图对象,对场景级草图理解关注甚少。为解决这一空白,我们引入了上下文感知图注意力Transformer网络(CGAT-Net),该网络利用对象间的视觉和空间关系来获得场景中更准确的分类。这是场景草图识别领域首个在基于Transformer的网络中利用对象关系来纳入上下文理解的研究。大量实验表明,CGAT-Net超越了当前最先进的单草图分类器,凸显了上下文信息在增强单个草图识别方面的价值。

快捷操作

分享

分享当前页面

ios_share

https://hci.top/zh/papers/iui/195807/2025

广告推荐

学习 AI 编程到 CodeNow

open_in_new打开DOI链接
DOI: https://doi.org/10.1145/3708359.3712135
一眼看懂

论文快照

fact_check
dataset
来源
IUI
calendar_month
年份
2025
emoji_events
奖项
未标记奖项
group
作者
2 位作者
sell
研究子方向
交互式数据可视化、计算方法在HCI中的应用
work
职业/产业
软件工程师与开发者、UI/UX 设计师、AI/ML 研究员与工程师
article
内容状态
仅摘要
hub
相关论文
10 篇相关论文