视角问题:对比人类和大型语言模型在微妙性别歧视主观决策中的论证
作者
大语言模型(LLM)的人机协作AI 伦理、公平与问责算法公平与偏见AI/ML 研究员与工程师律师与法律研究员HCI 研究员
研究背景与问题
- 问题与挑战:作者关注于主观决策中大语言模型(LLMs)和人类在处理微妙性别歧视场景中的表现,特别是在观点的分布和多样性上存在的差异。主观决策不同于以客观数据为基础的任务,它依赖于语境的解释和价值观的判断。
- 重要性:微妙性别歧视是一种隐蔽的偏见形式,解读因个人背景而异,对其识别和处理具有文化和社会方面的挑战性。AI辅助的主观决策提供了服务于多样观点的一种潜在工具,但这可能伴随偏见和视角局限。
- 研究动机与相关工作:过去的研究已关注LLMs在客观任务中的能力,但在主观决策中的表现尚未得到充分评估,而主观任务需要关注诸如“观点多样性”和“多视角理解”这类复杂问题。
解决方案
- 方法:作者将人类和多种LLMs(如GPT-3、GPT-3.5、GPT-4和Llama 3.1)在处理101个微妙性别歧视场景中的观点分布和立场进行对比分析。观点被细化为三种类型:受害者(victim)、施害者(perpetrator)和决策者(decision-maker);立场分为四种:性别歧视(sexist)、非性别歧视(not sexist)、依赖条件(depends)和无立场(no stance)。
- 创新之处:
- 观点及立场分类框架:系统化定义“观点”和“立场”,尤其在复杂社会互动中抓取LLM与人类决策的差异。
- 比较方法:通过定量分析(如ANOVA检验)结合定性评估,系统识别出不同模型和人类在主观决策中的表现差异。
- 无基准训练:人类决策数据未被视为“黄金标准”,而是与模型数据对等对比。
- 实施步骤:
- 数据收集:构建性别歧视场景数据集;通过问卷调查和模型生成模拟,收集人类和LLMs的回应。
- 编码与分析:迭代编制“立场”和“观点”分类标准,结合各数据源的频率统计和一致性分析。
- 比较模型:将人类与LLMs(包括不同代际版本的GPT和开源Llama模型)进行横向比较。
研究成果
- 具体成果:
- 立场分布:人类和GPT-3更倾向于简单和主观化的回答,如以“这是事实”为理由否认场景中的歧视性。而GPT-3.5、GPT-4和Llama 3.1则倾向于使用“依赖条件(depends)”立场,显示出更高的分析谨慎度和情境敏感性。
- 观点分布:Llama 3.1显著偏向“受害者”观点(95%的回应采用),而GPT-3.5和GPT-4则更多结合“受害者”和“施害者”以提供多视角解释。与之相比,人类参与者的回应较少解释多视角。
- 一致性:GPT-3的立场一致性最低,而GPT-3.5和Llama 3.1显示出更高的一致性,与人类偏低的反应一致性形成对比。
- 行为差异:GPT-3在部分回答中模仿人类经验(甚至自我标识为女性),可能导致“拟人化”和“诡异谷效应”。相比之下,新版GPT和Llama 3.1更明确声明AI模型的局限性。
- 优势:
- 多视角意见:新版LLMs(尤其为GPT-3.5、GPT-4和Llama 3.1)提供了更为全面和多维的视角,展示了人类未考虑的看法,展现协作潜力。
- 模型改进:较早版本(如GPT-3)则表现为更简单直接的答复,在社会复杂性问题上的表现空间较大。
- 局限性与未来方向:
- 单一任务域:本研究聚焦于微妙性别歧视,以其作为主观决策的案例应用,但它在其他主观任务域(如种族主义、年龄歧视)中的适用性有待验证。
- 数据互漏风险:部分场景可能出现在LLMs的训练集中,这可能导致结果偏差。
- 语言提示(Prompt)的局限性:不同提示策略的影响未来需进一步探索。
- 人机互补:如何精确设计AI作为“补充性意见提供者”(而非简单模仿人类),需要更复杂的校准技术与应用策略。
总结
这项研究通过比较人类与不同年代LLMs在主观决策中的表现,提出了“立场”和“观点”作为评估与设计主观AI辅助系统的关键参数。通过系统性分析不同LLMs和人类处理复杂社会问题的差异,本文不仅为LLMs的应用提供了重要的设计启示,也为未来的人工智能伦理和安全评价奠定了方向。
研究问题 / 现实痛点
这篇论文在当前问题库中对应的问题线索。
help
研究问题
3- 在处理微妙性别歧视场景的主观决策中,LLMs(大语言模型)与人类在观点分布和多样性上有何不同?分类: LLM界面、提示与交互理解同类问题arrow_forward
- 不同代际的LLMs(例如GPT-3、GPT-4、Llama 3.1)在处理主观决策时的表现有何差异?分类: LLM界面、提示与交互理解同类问题arrow_forward
- 引入“观点”和“立场”作为衡量参数能否帮助更明确地评估LLMs在复杂社会问题中的决策表现?分类: LLM界面、提示与交互理解同类问题arrow_forward
lightbulb
现实痛点
1- 用户和AI在处理微妙性别歧视问题时缺乏共同理解和多元视角。分类: LLM界面、提示与交互理解同类问题arrow_forward
- 71%
当刻板印象GTG:预测性文本建议对人与AI协作写作中性别偏见的影响
CHI '26· 大语言模型(LLM)的人机协作 +2
- 67%
走向实践中的公平性:评估公平机器学习工具包的实践者导向标准
CHI '21· AI 伦理、公平与问责 +1
- 67%
陪审团学习:将不同意见整合到机器学习模型中
CHI '22· AI 伦理、公平与问责 +1
- 67%
有能力但不道德?比较AI和人类专家在道德决策中的合作
CHI '22· AI 伦理、公平与问责 +1
- 67%
脱离上下文:调查“人工智能作为服务”的偏见和公平性问题
CHI '23· AI 伦理、公平与问责 +1
- 67%
这目前是杂乱无章的:考察AI/ML从业者在负责任的AI价值观共同生产过程中的挑战
CHI '23· AI 伦理、公平与问责 +1
- 67%
STILE:探索和调试预训练文本表示中的社会偏见
CHI '24· AI 伦理、公平与问责 +1
- 63%
反对无效!普通民众可以区分大型语言模型和律师,但仍倾向于接受LLM的建议
CHI '25· 大语言模型(LLM)的人机协作 +2
- 63%
「请不要杀死唯一让人感觉像人的模型」: 理解 #Keep4o 反对运动
CHI '26· 生成式AI(文本、图像、音乐、视频) +3
- 63%
机器中的心灵?人工智能中意识感的跨学科认知
CHI '26· 大语言模型(LLM)的人机协作 +3
基于研究子主题与职业分类的 Jaccard 相似度(≥60%)
快捷操作
广告推荐
学习 AI 编程到 CodeNow
open_in_new打开DOI链接
DOI: https://dl.acm.org/doi/10.1145/3706598.3713248
一眼看懂
fact_check论文快照
dataset
来源
CHI
calendar_month
年份
2025
emoji_events
奖项
未标记奖项
group
作者
5 位作者
sell
研究子方向
大语言模型(LLM)的人机协作、AI 伦理、公平与问责、算法公平与偏见
work
职业/产业
AI/ML 研究员与工程师、律师与法律研究员、HCI 研究员
article
内容状态
已索引正文
hub
相关论文
10 篇相关论文