Geno:为现有Web应用编写多模态交互的开发者工具
作者
语音用户界面(VUI)设计对话式聊天机器人软件工程师与开发者UI/UX 设计师AI/ML 研究员与工程师
在应用中支持语音命令能为用户带来显著好处。然而,如我们形成性研究所示,由于缺乏创建多模态界面的统一支持,为现有基于GUI的Web应用添加此类支持既耗时又具有高学习门槛。我们提出Geno,这是一个开发者工具,无需太多NLP专业知识即可为现有Web应用添加语音输入模态。Geno为开发者提供高级工作流程,用于指定语音支持的功能(意图),创建从用户话语中检测意图和相关信息的语言模型,并通过编程调用相应功能或重放Web应用上的GUI操作来满足意图。Geno还支持语音命令中对GUI上下文的多模态引用(例如,在将光标指向事件时说“把这个[事件]移至下周”)。研究表明,几乎没有NLP专业知识的开发者能够使用Geno为两个现有Web应用添加多模态语音命令支持。
研究问题 / 现实痛点
这篇论文在当前问题库中对应的问题线索。
当前问题库还没有收录这篇论文的问题与痛点。
快捷操作
广告推荐
学习 AI 编程到 CodeNow
open_in_new打开DOI链接
DOI: https://dl.acm.org/doi/10.1145/3379337.3415848
一眼看懂
fact_check论文快照
dataset
来源
UIST
calendar_month
年份
2020
emoji_events
奖项
未标记奖项
group
作者
6 位作者
sell
研究子方向
语音用户界面(VUI)设计、对话式聊天机器人
work
职业/产业
软件工程师与开发者、UI/UX 设计师、AI/ML 研究员与工程师
article
内容状态
仅摘要
hub
相关论文
4 篇相关论文