AI能为我做什么: 评估合作游戏中机器学习解释的效果

大语言模型(LLM)的人机协作可解释人工智能(XAI)AI 辅助决策与自动化系统AI/ML 研究员与工程师HCI 研究员

机器学习是决策的重要工具,但其伦理和负责任的应用需要对可解释性和实用性进行严格审查,这一问题在自然语言处理模型中尤其未被充分研究。我们提出在真实任务中与真实用户一起评估解释效果,通过人类性能的提升程度来衡量解释的有效性。我们使用问答任务Quizbowl设计了一个真实的人机合作设置。让 trivia 专家和新手与计算机作为队友一起玩游戏,计算机通过三种不同的解释方式传达其预测。我们还为自然语言处理中的人机协作设置提供了设计指导。

快捷操作

分享

分享当前页面

ios_share

https://hci.top/zh/papers/iui/3207/2019

广告推荐

学习 AI 编程到 CodeNow

一眼看懂

论文快照

fact_check
dataset
来源
IUI
calendar_month
年份
2019
emoji_events
奖项
未标记奖项
group
作者
2 位作者
sell
研究子方向
大语言模型(LLM)的人机协作、可解释人工智能(XAI)、AI 辅助决策与自动化系统
work
职业/产业
AI/ML 研究员与工程师、HCI 研究员
article
内容状态
仅摘要
hub
相关论文
10 篇相关论文