会话式解释:与非AI专家讨论可解释AI
作者
可解释人工智能(XAI)AI/ML 研究员与工程师HCI 研究员
可解释AI旨在为AI模型决策提供洞见,但目前大多数XAI方法仅提供一次性静态解释,无法满足用户不同的知识水平和信息需求。会话式解释被提出作为定制XAI解释的有效方法。然而构建会话式解释系统受限于训练数据稀缺,使用合成数据面临两个主要挑战:数据多样性不足和生成数据的幻觉问题。为缓解这些问题,研究引入重复惩罚以促进数据多样性,并利用幻觉检测器过滤不真实的合成对话轮次。研究对所提出的EMCEE系统进行自动和人工评估。自动评估显示EMCEE相对基线在BLEU上提升81.6%、ROUGE上提升80.5%,同时缓解了合成数据训练导致的质量下降问题。在60人参与的人工评估中,EMCEE在提升用户理解、接受、信任和与静态解释的协作方面显著优于基线模型和对照组。细粒度分析进一步表明,基于自生成合成数据的训练提高了模型生成更真实和可理解答案的能力,带来更好的用户交互体验。据我们所知,这是首个能跟随静态解释回答自由形式用户问题的会话解释方法。
研究问题 / 现实痛点
这篇论文在当前问题库中对应的问题线索。
help
研究问题
3- 如何设计一个交互式对话型可解释AI系统,以满足用户的知识水平、信息需求和任务背景?分类: 虚假信息、内容标注与真实性信任同类问题arrow_forward
- 如何通过少样本(few-shot)生成和过滤机制改善合成对话数据的多样性和质量?分类: 虚假信息、内容标注与真实性信任同类问题arrow_forward
- 采用哪些创新方法可以减少生成对话中的幻觉(错误信息)问题?分类: 虚假信息、内容标注与真实性信任同类问题arrow_forward
lightbulb
现实痛点
1- 非专家用户难以理解和信任复杂AI系统的决策原因。分类: 虚假信息、内容标注与真实性信任同类问题arrow_forward
- 75%
操纵和测量模型可解释性
CHI '21· 可解释人工智能(XAI) +1
- 75%
每个人都想做模型工作,而不是数据工作:高风险人工智能中的数据级联
CHI '21· 可解释人工智能(XAI) +1
- 75%
整体是否超过其部分?AI解释对互补团队绩效的影响
CHI '21· 可解释人工智能(XAI) +1
- 75%
共享兴趣:测量人机对齐以识别模型行为中的重复模式
CHI '22· 可解释人工智能(XAI) +1
- 75%
去偏CAM以减轻图像扰动并提供机器学习的忠实可视化解释
CHI '22· 可解释人工智能(XAI) +1
- 75%
文本分类中的公平性评估:机器学习从业者对个体和群体公平性的看法
CHI '23· 可解释人工智能(XAI) +1
- 75%
一种人工智能并不适合所有人:关于普通人对人工智能角色认知的聚类分析
CHI '23· 可解释人工智能(XAI) +1
- 75%
"帮助我帮助AI": 理解可解释性如何支持人机交互
CHI '23· 可解释人工智能(XAI) +1
- 75%
不要只是告诉我,问我:将解释作为问题来智能构建的AI系统可以提高人类逻辑辨别准确性,超过因果AI解释
CHI '23· 可解释人工智能(XAI) +1
- 75%
DeepSeer:通过状态抽象进行交互式RNN解释和调试
CHI '23· 可解释人工智能(XAI) +1
基于研究子主题与职业分类的 Jaccard 相似度(≥60%)
快捷操作
广告推荐
学习 AI 编程到 CodeNow
open_in_new打开DOI链接
DOI: https://doi.org/10.1145/3708359.3712143
一眼看懂
fact_check论文快照
dataset
来源
IUI
calendar_month
年份
2025
emoji_events
奖项
未标记奖项
group
作者
5 位作者
sell
研究子方向
可解释人工智能(XAI)
work
职业/产业
AI/ML 研究员与工程师、HCI 研究员
article
内容状态
仅摘要
hub
相关论文
10 篇相关论文