"社区指南让这成为互联网上最好的聚会": 对在线平台内容审核政策的深入研究
作者
社交平台设计与用户行为内容审核与平台治理虚假信息与事实核查政府官员与公务员内容治理与平台合规团队HCI 研究员
文献标题
“Community Guidelines Make this the Best Party on the Internet”: An In-Depth Study of Online Platforms’ Content Moderation Policies
文献信息
- 主题领域: 在线平台的内容审核政策
- 关键词: 内容审核, 数据集, 定性分析, 定量分析, 社区指南, 平台规则, 用户生成内容, 版权违规, 仇恨言论, 错误信息
研究背景与问题
- 问题或挑战: 在线平台需要平衡用户的安全和言论自由,这涉及复杂的内容审核政策问题。现有研究缺乏对不同平台和主题内容审核政策的系统性比较理解。此外,许多内容审核政策结构复杂,分散在多个网页中,用户难以获得清晰的政策信息。
- 重要性: 随着全球范围内互联网对社会讨论的巨大影响,内容审核政策影响用户行为并塑造社会话语,是平台运营的核心问题。内容审核涉及法律合规和社会责任,但在许多国家,该领域缺乏清晰的法律框架,导致政策的不一致和潜在的偏差。
- 研究动机和相关工作: 过去的研究集中在某些单一平台的内容审核规则上或对用户行为的有限探讨上,鲜有关于跨平台及多主题内容审核政策的比较研究。本研究旨在为未来的政策研究提供基础数据,并探讨政策结构与执行的差异性。
解决方案
- 研究方法:
- 构建一个自定义的网络爬虫,收集43个最大在线平台的内容审核政策文本。
- 针对三大主题(版权侵权、仇恨言论和误导性内容)开发统一的注解方案(代码本),以捕捉关键的政策组成部分。
- 对政策文本进行定性和定量的混合分析,以揭示各平台和主题内容审核政策的异同。
- 创新之处:
- 创建了开源的政策收集管道,能够持续更新数据集。
- 开发了专注于用户视角的内容政策注解框架。
- 提供了一个标注完备的开源政策数据集(OCMP-43),支持后续深入研究。
- 实施步骤:
- 政策收集: 利用爬虫定位和提取政策文本,解决动态加载、内容散落等挑战。
- 注解分析: 通过代码本对政策文本进行人工多轮标注和校对,辅助政策间的跨平台比较。
- 成果展示: 对跨主题和平台的政策进行结构化分析,统计政策组成部分及其分布,揭示不同的执行方式。
研究成果
- 具体成果:
- 构建了43个平台(OCMP-43)内容审核政策数据集,覆盖三大主题、超过1000页标注文档和上万段文本标注。
- 分析揭示了平台在政策结构和组成上的显著差异,特别是在政策的定义、用户与平台的角色分配及申诉机制中。
- 发现版权相关政策较其他主题更依赖明确的法律框架,而仇恨言论和错误信息政策则常以社区价值为驱动。
- 优势: 提供了首次大规模跨平台政策比较研究,对平台政策结构、法理依据、以及用户与平台的互动模式提供了系统性洞察。
- 实验或评估结果:
- 平台在政策组成部分的完整性上差异显著,仅39.5%的平台涵盖关键内容审核政策的所有重要部分。
- 用户在错误信息和仇恨言论规则下往往缺乏有效的申诉渠道,而版权侵权政策中申诉流程更完善。
- 政策中缺乏具体定义,更多依赖于模糊的例子,对用户理解和执行提出挑战。
- 局限性与未来方向:
- 数据集覆盖范围仅为英文平台,未覆盖非英语语境。
- 政策爬取和标注存在噪声和冗余,以后可进一步增强自动化手段以提高效率。
- 建议未来研究探索平台的实际执行情况,以填补政策与实践间的潜在差距。
- 数据集可扩展到其他主题(如生成式AI内容)或动态追踪政策的演变。
总结
本文通过构建OCMP-43数据集并进行大规模跨平台分析,为平台内容审核政策的研究提供系统性框架和数据支持。研究揭示了在线平台内容审核政策的多样性和现存挑战,为政策改进和用户研究指明了方向。
研究问题 / 现实痛点
这篇论文在当前问题库中对应的问题线索。
help
研究问题
3- 不同在线平台的内容审核政策在结构和关键组件上有哪些相似点和差异?分类: 错误信息治理与公共健康信息同类问题arrow_forward
- 在哪些主题(如版权、仇恨言论、错误信息)中内容审核政策更依赖法律框架或社区价值?分类: 错误信息治理与公共健康信息同类问题arrow_forward
- 当前的内容审核政策如何影响用户与平台的互动,例如申诉机制的可用性?分类: 错误信息治理与公共健康信息同类问题arrow_forward
lightbulb
现实痛点
1- 用户很难获取清晰的内容审核政策信息,不知道自己权益如何受到保护。分类: 错误信息治理与公共健康信息同类问题arrow_forward
- 71%
《“信任与安全”的终结?:探讨内容审查的未来及专业在线安全努力的动荡》
CHI '25· 在线骚扰与反制工具 +2
- 67%
合成社交信号:从账户历史中计算得出的社交信号
CHI '20· 社交平台设计与用户行为 +1
基于研究子主题与职业分类的 Jaccard 相似度(≥60%)
快捷操作
广告推荐
学习 AI 编程到 CodeNow
open_in_new打开DOI链接
DOI: https://doi.org/10.1145/3613904.3642333
一眼看懂
fact_check论文快照
dataset
来源
CHI
calendar_month
年份
2024
emoji_events
奖项
未标记奖项
group
作者
10 位作者
sell
研究子方向
社交平台设计与用户行为、内容审核与平台治理、虚假信息与事实核查
work
职业/产业
政府官员与公务员、内容治理与平台合规团队、HCI 研究员
article
内容状态
已索引正文
hub
相关论文
2 篇相关论文