模型可解释性和结果反馈对AI信任的影响
文献标题
Impact of Model Interpretability and Outcome Feedback on Trust in AI
文献信息
- 主题领域: 人机交互 (HCI)、人工智能信任和协作性能
- 关键词: 人机系统, 混合智能, 机器学习, AI信任, 人类实验, AI辅助决策, 可解释性AI, 结果反馈
研究背景与问题
-
发现问题或挑战: 人工智能在多领域表现优质,但用户并未广泛采纳。这种对算法的抗拒被称为“算法厌恶”(algorithm aversion),可能源于两个主要因素:其一是缺乏可解释性;其二是对模型性能缺乏信任。
-
重要性: 开发有效的AI系统不仅需要高性能,还需要让用户信任该系统,进而实际采用并受益于AI建议。信任不仅能够推动AI技术的普及,还能增强人类与AI协作的效果。
-
研究动机与相关工作: 过去研究探讨了可解释性对用户信任的影响,但结果并不一致。有些研究发现可解释性可以提高用户信任,而另一些则发现其作用有限。此外,与模型性能相关的信息(如准确率或错误率)也受到关注。本研究旨在比较这两类因素,即可解释性和结果反馈对用户信任和协作性能的影响。
解决方案
-
提出的解决方案: 通过预注册的实验设计,研究AI模型的可解释性和结果反馈如何分别影响用户任务表现和对AI的信任。
-
创新之处:
- 首次比较了可解释性和结果反馈这两组因素对AI信任和协作性能的综合影响,并探讨它们间的交互作用。
- 使用“建议权重”(Weight of Advice, WoA)作为行为信任的测量方式,以分离用户信任与模型准确度的影响。
-
实施步骤:
- 实验设计采用两阶段任务:第一阶段让参与者在无AI建议帮助下完成预测任务;第二阶段参与者接收AI预测并可以调整自身预测。
- 设置六种实验情况,分别结合不同类型可解释性(无可解释性、全局可解释性、局部可解释性)与结果反馈(有反馈或无反馈)。
- 使用真实数据(速度约会数据集)训练AI模型,并对参与者进行随机分组以确保实验结果的稳定性。
研究成果
-
具体成果:
- 信任: 结果反馈对用户行为信任(WoA)的影响明显高于可解释性。无论是全局可解释性还是局部可解释性,并未显著提高信任。
- 协作性能: 结果反馈提升了用户任务表现,但其提升幅度远低于对信任的影响。可解释性未显著提高任务表现。
-
与现有解决方案比较: 本研究挑战了传统观点,即可解释性是提升AI信任的关键。发现结果反馈可能是提高AI可信度和采用率的更有效方法。
-
实验或评估结果:
- 在接受结果反馈的情况下,用户倾向于信任AI建议,但也更容易出现过度信任(overshooting)或欠信任(contradicting),从而引发“信任-性能悖论”。
- 时间趋势分析表明,当用户发现AI建议降低其表现时,后续对AI建议的信任显著下降,这进一步削弱了协作效率。
-
局限性与未来方向:
- 研究集中在一个特定情境(速度约会预测任务),需要进一步验证不同情境下结果反馈与可解释性的影响。
- 本研究仅测试了有限种类的可解释性展示形式,未来可探索“对比性解释”或“反事实解释”等其他形式。
- 未来研究可综合使用行为信任(WoA)和信任校准(Trust Calibration)指标,以更系统性地理解AI信任与协作性能的动态关系。
总之,本研究揭示了结果反馈比可解释性更能增强用户对AI的信任,同时揭示了提高信任可能并不总能带来协作性能的显著提升,为HCI领域设计可信AI系统提供了新的思路。
研究问题 / 现实痛点
这篇论文在当前问题库中对应的问题线索。
研究问题
3- AI模型的可解释性如何影响用户对AI的信任?分类: AI 决策支持与依赖行为同类问题arrow_forward
- 结果反馈在提高用户对AI的信任中起到什么作用?分类: AI 决策支持与依赖行为同类问题arrow_forward
- 可解释性和结果反馈能否交互作用以改善人机协作的表现?分类: AI 决策支持与依赖行为同类问题arrow_forward
现实痛点
1- 用户难以信任AI推荐,导致不愿使用AI辅助决策。分类: AI 决策支持与依赖行为同类问题arrow_forward
- 100%
当性能反馈有限时人类对机器学习模型的依赖:启发法和风险
CHI '21· 可解释人工智能(XAI) +1
- 100%
机器教学中的深度学习不确定性
IUI '22· 可解释人工智能(XAI) +1
- 100%
人们在认知上参与AI交互吗?AI辅助对附带学习的影响
IUI '22· 可解释人工智能(XAI) +1
- 100%
辅助决策中的理论责任、测量责任与主观责任
IUI '22· 可解释人工智能(XAI) +1
- 67%
忽略、信任还是协商:理解临床医生在医疗保健中对基于AI的治疗建议的接受程度
CHI '23· 可解释人工智能(XAI) +1
- 67%
Time2Stop:用于智能手机过度使用干预的自适应和可解释的人工智能循环
CHI '24· 可解释人工智能(XAI) +2
- 67%
可探索的可解释AI:提高印度社区健康工作者对AI的理解
CHI '24· 可解释人工智能(XAI) +1
- 67%
AI,帮助我思考——但要我自己做决定:通过提供不同类型的认知支持来协助人们进行复杂决策
CHI '25· 可解释人工智能(XAI) +1
- 67%
通过交互视角探索用户参与度:文本线索告诉我们关于人机交互的什么信息
CUI '24· 对话式聊天机器人 +2
- 67%
情绪是否影响智能手机打字时自动建议的使用?
IUI '19· 生成式AI(文本、图像、音乐、视频) +2
基于研究子主题与职业分类的 Jaccard 相似度(≥60%)