AROMA:通过在现实与视频间建立多模态信息的混合主动式AI辅助非视觉烹饪
作者
对话式聊天机器人视觉障碍者技术(屏幕阅读器、触觉图形、盲文)环境感知与上下文计算残障服务提供者辅助技术专家
视频提供丰富的视听信息,可以支持人们进行日常生活活动(ADL),但对视障人士来说仍然难以访问。在烹饪中,视障人士通常依赖非视觉线索——如触觉、味觉和嗅觉——来导航环境,这使得他们难以跟随视频食谱中主要以视听形式呈现的指令。为了解决这个问题,我们引入了 AROMA,这是一种基于AI的系统,通过整合用户感知的非视觉线索、可穿戴摄像头画面和视频食谱内容,根据实时上下文感知协助提供及时响应。AROMA 采用混合主动式方法:它响应用户请求,同时主动监控视频流以提供及时警报和指导。这种协作设计利用用户和AI系统的互补优势,将物理环境与视频食谱对齐,帮助用户理解当前的烹饪状态并理解各个步骤。我们通过对八名视障参与者进行研究和提供洞察力评估了 AROMA,以设计支持视障人士执行日常活动的交互式AI系统。
研究问题 / 现实痛点
这篇论文在当前问题库中对应的问题线索。
当前问题库还没有收录这篇论文的问题与痛点。
- 80%
Snap&Nav:面向盲人的基于智能手机的室内导航系统,通过楼层地图分析和交叉口检测
MobileHCI '24· 视觉障碍者技术(屏幕阅读器、触觉图形、盲文) +1
- 67%
LineChaser: 一款帮助盲人排队的智能手机导航系统
CHI '21· 视觉障碍者技术(屏幕阅读器、触觉图形、盲文) +2
- 60%
面向视障人士的面部识别应用程序:超越实验室的理解使用
CHI '18· 视觉障碍者技术(屏幕阅读器、触觉图形、盲文)
- 60%
使视障人士能够使用触觉和听觉手杖模拟导航虚拟现实
CHI '18· 视觉障碍者技术(屏幕阅读器、触觉图形、盲文)
- 60%
转向轮:一种用于低视力网络浏览的保局放大界面
CHI '18· 视觉障碍者技术(屏幕阅读器、触觉图形、盲文)
- 60%
Caption Crawler:利用反向图像搜索实现可重复使用的替代文本描述
CHI '18· 视觉障碍者技术(屏幕阅读器、触觉图形、盲文)
- 60%
探索技术在提升视力丧失者生活质量方面的机遇
CHI '19· 视觉障碍者技术(屏幕阅读器、触觉图形、盲文)
- 60%
为视障人士提供远程视觉辅助的新兴专业实践
CHI '20· 对话式聊天机器人 +1
- 60%
LightWrite:使用智能手机教授盲人手写
CHI '21· 视觉障碍者技术(屏幕阅读器、触觉图形、盲文)
- 60%
触觉凝视:视障人士探索凸起线条图形的行为标志
CHI '21· 视觉障碍者技术(屏幕阅读器、触觉图形、盲文)
基于研究子主题与职业分类的 Jaccard 相似度(≥60%)
快捷操作
广告推荐
学习 AI 编程到 CodeNow
open_in_new打开DOI链接
DOI: https://doi.org/10.1145/3746059.3747650
一眼看懂
fact_check论文快照
dataset
来源
UIST
calendar_month
年份
2025
emoji_events
奖项
未标记奖项
group
作者
9 位作者
sell
研究子方向
对话式聊天机器人、视觉障碍者技术(屏幕阅读器、触觉图形、盲文)、环境感知与上下文计算
work
职业/产业
残障服务提供者、辅助技术专家
article
内容状态
仅摘要
hub
相关论文
10 篇相关论文