文本分类中的公平性评估:机器学习从业者对个体和群体公平性的看法
作者
可解释人工智能(XAI)算法公平与偏见AI/ML 研究员与工程师HCI 研究员
文献标题
公平性评估在文本分类中的应用:个体与群体公平性的机器学习从业者视角
文献信息
- 主题领域: 机器学习与自然语言处理中的公平性评估
- 关键词: 公平性评估, 文本分类, 群体公平性, 个体公平性, 人机交互, 有毒文本识别, 算法偏差, 透明性
研究背景与问题
-
问题与挑战:
- 机器学习模型可能因算法偏差而导致社会不公平,例如皮肤颜色识别准确性不足、搜索引擎中的代表性偏差以及翻译服务中的性别偏见。
- 尽管已有许多工具包帮助开发者应对算法偏差(如公平性评估),在实际实践中,模型公平性如何被评估仍缺乏深入研究。
- 文本分类中用户如何探索不同的公平性维度(如个体公平性与群体公平性),尚未充分调查。
-
研究重要性:
- 确保人工智能的公平性不仅对社会发展有积极影响,也经常涉及法律法规的要求。
- 减少NLP系统对不同人口统计组的不公平性,有助于提高AI技术的伦理性与技术信任。
-
研究动机:
- 填补当前缺乏对机器学习从业者关于算法公平性评估视角的理解。
- 探讨用户在与文本分类公平性工具交互时的探索策略及其背后的动机。
解决方案
-
提出的方法:
- 开发一个交互式工具,允许用户动态探索文本分类模型公平性,包括:
- 群体公平性指标 (Group Fairness Metrics)
- 个体公平性指标 (Individual Fairness Metrics)
- 自定义输入的实验机制,允许用户探索模型对设定的输入的性能。
- 开发一个交互式工具,允许用户动态探索文本分类模型公平性,包括:
-
创新之处:
- 研究用户在群体或个体公平性维度上的决策如何受多样化但静态的指标影响。
- 提供数据的分组视图和单句实例的交互视图,研究从业者如何自定义输入并偏向不同的实验方法。
-
实施步骤与关键技术:
- 构建一种考虑公平性交互的工具,支持以下四种模式:
- 预定义的群体公平性视图
- 预定义的个体公平性视图
- 自定义群体输入视图
- 自定义个体输入视图
- 运用情景化实验,展示3个不同文本分类模型(普通模型、个体公平模型、群体公平模型)的性能与公平性数据。
- 收集用户在每类指标下的模型选择及其背后策略。
- 对应公平性维度,提供个别实验的综合反馈,包括指标变化趋势。
- 统计参与者基于交互与公平性指标对模型选择的偏好,提炼用户对公平性指标的主观偏好。
- 构建一种考虑公平性交互的工具,支持以下四种模式:
研究成果
-
具体成果:
- 开发了一个前端交互工具,用于在文本分类任务中探索群体公平性和个体公平性。
- 得出如下主要发现:
- 提供的公平性指标(如准确性和公平性)的种类显著影响用户对选择哪个模型作为“最公平模型”的判断。
- 在自定义输入的实验中,用户更倾向于关注与自己个人经历或当前社会新闻相关的输入维度。
- 用户在探索群体公平性和个体公平性时采用了不同的策略,如根据相似的身份类别分组,或尝试生成“对抗性输入”。
-
优势:
- 通过实验,证明相比单一评估标准,呈现多视角(如群体和个体公平性)能够帮助用户做出更符合现实需求的公平性评估。
- 工具设计展现较强的用户灵活性,允许从业者深度自定义和分析潜在模型偏差。
-
实验或评估结果:
- 在任务1(只看预测准确性)中,大多数用户选择普通模型(88%)。但在任务2(群体公平性视图)下,有50%的用户转而选择群体公平模型。任务3中,67%的用户选择了个体公平模型。
- 自定义实验输出显示,用户对公平指数的理解和偏好在很大程度上取决于工具所呈现的视图种类与交互的灵活性。
- 用户倾向于模型能在保持准确度的同时避免改变对特定群体的公平性预测。
-
局限性与未来方向:
- 文献主要聚焦于针对性任务(如文本分类),需进一步验证该工具在其他领域(如推荐系统或语音识别)中的适用性。
- 使用词汇匹配方式筛选少数群体数据可能遗漏隐性内容关联(如未明确提及少数群体但涉及的有毒内容)。
- 未来研究可优化个体与群体公平性指引,并研究如何为不同用户群体提供定制化交互体验。
通过本研究,作者建议在开发评估公平性工具时,增加上下文信息、设计组间相似性提示以及优化不对称反事实指标生成,从而提高工具的实用性与有效性。
研究问题 / 现实痛点
这篇论文在当前问题库中对应的问题线索。
help
研究问题
3- 在文本分类中,个体公平性和群体公平性如何影响机器学习实践者的评估决策?分类: 机器学习公平性与数据开发实践同类问题arrow_forward
- 用户在探索公平性指标时会采用哪些不同的策略?分类: 机器学习公平性与数据开发实践同类问题arrow_forward
- 如何设计一个互动工具帮助用户动态评估文本分类模型的公平性?分类: 机器学习公平性与数据开发实践同类问题arrow_forward
lightbulb
现实痛点
1- 机器学习中的算法偏见会导致AI系统对群体或个体不公平。分类: 机器学习公平性与数据开发实践同类问题arrow_forward
- 100%
每个人都想做模型工作,而不是数据工作:高风险人工智能中的数据级联
CHI '21· 可解释人工智能(XAI) +1
- 100%
对机器学习中多重性公平影响的认知
CHI '25· 可解释人工智能(XAI) +1
- 80%
超越专业知识和角色:一个框架来描述可解释机器学习的利益相关者及其需求
CHI '21· 可解释人工智能(XAI) +2
- 80%
用户驱动的价值观对齐:理解用户对AI伴侣中偏见和歧视性陈述的看法及应对策略
CHI '25· 可解释人工智能(XAI) +2
- 80%
不仅仅是营销?关于人工智能基准测试对从业者的信息价值
IUI '25· 可解释人工智能(XAI) +1
- 75%
为算法素养和透明度设计交互式可解释人工智能工具
DIS '24· 可解释人工智能(XAI) +1
- 75%
会话式解释:与非AI专家讨论可解释AI
IUI '25· 可解释人工智能(XAI)
- 67%
表达方式会影响决策吗?探讨AI解释语气对决策制定的影响
CHI '25· 可解释人工智能(XAI) +2
- 67%
解释模型:一项关于解释如何影响公平性判断的实证研究
IUI '19· 可解释人工智能(XAI) +2
- 67%
解释对人类-AI决策公平性的影响:保护特征与代理特征
IUI '24· 可解释人工智能(XAI) +2
基于研究子主题与职业分类的 Jaccard 相似度(≥60%)
快捷操作
广告推荐
学习 AI 编程到 CodeNow
open_in_new打开DOI链接
DOI: https://doi.org/10.1145/3544548.3581227
一眼看懂
fact_check论文快照
dataset
来源
CHI
calendar_month
年份
2023
emoji_events
奖项
未标记奖项
group
作者
7 位作者
sell
研究子方向
可解释人工智能(XAI)、算法公平与偏见
work
职业/产业
AI/ML 研究员与工程师、HCI 研究员
article
内容状态
已索引正文
hub
相关论文
10 篇相关论文