探索道德基础与AI行为判断之间的关联
AI 伦理、公平与问责算法透明度与可审计性算法公平与偏见AI/ML 研究员与工程师隐私政策制定者HCI 研究员社会学家与人类学家
文献标题
探索道德基础与人工智能行为判断之间的关联
文献信息
- 主题领域: 人工智能伦理学、道德心理学
- 关键词: 道德基础理论, 负责任的人工智能, 自动决策, 伦理原则, 指南
研究背景与问题
-
发现的问题或挑战:
- 人工智能(AI)的道德行为如何被个体感知和判断,尤其在涉及道德紧张的情境中,人们之间存在哪些分歧?
- 当前AI伦理指南的规范性方法未能充分考虑个体对道德行为的多样性解读。
-
研究重要性:
- 随着AI的应用越来越广泛,其行为经常被赋予道德含义,需要系统研究个体如何做出关联道德判断,以及个体道德构成如何影响这些判断。
- 探讨道德基础理论(Moral Foundations Theory, MFT)的预测能力,以为设计更符合人类需求的AI伦理原则提供参考。
-
研究动机与相关工作:
- 道德基础理论成功用于预测人们对特定人类行为(如安乐死、堕胎)的反应,但尚未能解释个体在AI行为判断中的差异。
- 当前AI伦理的规范性指南(如《蒙特利尔负责任AI宣言》)因未能充分捕捉多样化的人类反应而受到批评。
- 本文试图以经验性的方法补充这一研究领域,考察道德基础在AI伦理判断中的实际影响。
解决方案
-
研究方法:
- 使用道德基础问卷(Moral Foundations Questionnaire, MFQ)测量240位参与者的个体道德敏感性。
- 构建6个涉及AI道德行为的情境场景,并让参与者对这些情境进行判断,同时标注与其最相关的道德基础。
- 数据分析结合贝叶斯建模与反思性主题分析,以检验个体道德基础如何影响其对AI的道德判断。
-
创新之处:
- 首次验证MFT在人工智能行为判断中是否具有预测能力。
- 综合定量与定性方法,探索技术认知、人性化倾向等非道德驱动因素如何影响AI行为判断。
-
实施步骤与关键技术:
- 第一步: 随机分配参与者完成两部分内容——场景判断及MFQ问卷;
- 第二步: 使用贝叶斯模型分析关键变量间的关联;
- 第三步: 通过定性分析提取关于参与者的技术意识和伦理判断间的潜在联系主题,形成对参与者行为逻辑的解释。
研究成果
-
具体成果:
- 参与者对AI行为的判断表现出较弱的一致性,尤其在涉及“平等”、“权威”等情境时分歧较大。
- 个体的“关怀”道德基础(Care)得分最能预测其对AI行为的判断,而其他道德基础(如“忠诚”、“清洁”等)对预测能力的贡献较小。
- 定性分析发现,个体对AI的技术理解程度,是影响其伦理判断的重要非道德因素。未展示技术理解的参与者更倾向于将AI行为拟人化,将责任归因于AI本体。
-
与现有解决方案的比较与优势:
- 当前AI伦理指南以规范性为主忽略了个体差异,而本研究通过MFT强调了自然描述的多样性与预测性。
- 本研究揭示了技术认知与道德感知之间的关联,为AI系统的设计和用户教育提供了新的维度。
-
实验或评估结果:
- 在所有6个情境中,参与者对道德基础相关性的评分一致性(Kendall’s W)平均值为0.28,属于“有限一致性”范围。
- 贝叶斯建模显示,个体对“关怀”的道德敏感性是预测AI行为判断的主要变量(效应值为0.24)。
-
局限性与未来方向:
-
局限性:
- 单一文化背景:参与者主要来自英语背景国家(英国与美国),不具备广泛的文化适应性。
- 场景设计的广度:所选情境无法涵盖AI行为相关的所有情境可能性。
- 人工设置对真实环境的偏离:实验中人群和约束条件不同于现实世界的道德决策环境。
-
未来方向:
- 针对更广泛的文化与社会背景的扩展研究。
- 探讨技术认知教育对减少AI拟人化倾向并改善判断一致性的潜在影响。
- 进一步研究AI交互系统如何通过设计减少用户的拟人化倾向。
-
研究问题 / 现实痛点
这篇论文在当前问题库中对应的问题线索。
help
研究问题
3- 在涉及道德行为的情况下,AI的行为如何被个人判断,其判断标准如何因人而异?分类: 公平性、偏见与代表性同类问题arrow_forward
- 个体的道德基础(如关怀、公平)在多大程度上能够预测他们对AI行为的道德判断?分类: 公平性、偏见与代表性同类问题arrow_forward
- 技术认知和拟人化倾向如何影响个体对AI行为的道德评价?分类: 公平性、偏见与代表性同类问题arrow_forward
lightbulb
现实痛点
1- 用户对AI行为的道德判断缺乏一致性且受个人因素显著影响。分类: 公平性、偏见与代表性同类问题arrow_forward
- 75%
生活在他们的乌托邦中:为什么算法系统产生荒谬的结果
CHI '21· AI 伦理、公平与问责 +2
- 71%
拆解算法决策中的公平感知:解释、人类监督和可争议性的影响
CHI '23· AI 伦理、公平与问责 +2
- 63%
Silva: 使用因果关系交互式评估机器学习公平性
CHI '20· AI 伦理、公平与问责 +2
- 63%
共同设计检查表以了解组织在人工智能公平性方面的挑战和机遇
CHI '20· AI 伦理、公平与问责 +2
- 63%
面向用户驱动的算法审计:探究用户发现有害算法行为的策略
CHI '22· AI 伦理、公平与问责 +2
- 63%
算法污名化概念化
CHI '23· AI 伦理、公平与问责 +2
- 63%
访问 denied:定量算法审计的有意义的数据访问
CHI '25· 可解释人工智能(XAI) +2
- 63%
当刻板印象GTG:预测性文本建议对人与AI协作写作中性别偏见的影响
CHI '26· 大语言模型(LLM)的人机协作 +2
- 63%
AI能否成为道德受害者?道德能动性与所有权感知在AI生成内容使用伦理判断中的作用
CHI '26· 生成式AI(文本、图像、音乐、视频) +2
- 63%
为善资助AI:呼唤有意义的参与
CHI '26· AI 伦理、公平与问责 +2
基于研究子主题与职业分类的 Jaccard 相似度(≥60%)
快捷操作
广告推荐
学习 AI 编程到 CodeNow
open_in_new打开DOI链接
DOI: https://doi.org/10.1145/3613904.3642712
一眼看懂
fact_check论文快照
dataset
来源
CHI
calendar_month
年份
2024
emoji_events
奖项
未标记奖项
group
作者
3 位作者
sell
研究子方向
AI 伦理、公平与问责、算法透明度与可审计性、算法公平与偏见
work
职业/产业
AI/ML 研究员与工程师、隐私政策制定者、HCI 研究员、社会学家与人类学家
article
内容状态
已索引正文
hub
相关论文
10 篇相关论文