Inter(sectional) Alia(s): 通过交叉日本自我指称的身份中的语音代理的模糊性
智能语音助手(Alexa、Siri 等)多语言与跨文化语音交互会话代理的人格与拟人化
研究背景与问题
- 发现的问题:作者注意到人工智能对话代理在模仿人类交流时会产生伦理问题,特别是通过语言和声音表达社会身份可能会导致身份偏向或刻板印象。此外,许多工作未能深入探讨通过多重社会身份(例如交叉性身份标识)来理解AI身份。
- 问题的重要性:人工智能可能会无意间加剧性别、年龄、社会地位等偏见,影响用户对代理的信任和满意度。这种设计偏差可能对人机交互造成负面影响,其后果包括强化刻板印象或性别不平等。
- 研究动机与相关工作:现有研究大多集中在揭示算法偏见,但未能充分研究AI身份感知的交叉性视角。尤其在日语中,自我引用表达(例如代名词)不仅涉及性别,也充满了社会身份意义,包括年龄、正式程度和地域特色。
解决方案
- 研究方法:作者设计了一项基于众包的实验,使用了三种ChatGPT语音(Juniper、Breeze和Ember)以及七种日语自我引用方式(含性别中性与交叉性选项),探索这些语音与自我引用方式的组合如何影响用户的社会身份感知。
- 创新之处:
- 首次将语音与日语交叉性自我引用表达结合,研究AI的身份认知。
- 引入非代名词自我引用(例如使用名字代替代名词),作为日常且探索性的自我表达方式。
- 进而探讨哪些特定组合有助于逃避或模糊性别认知。
- 实施步骤:
- 利用ChatGPT生成不同语音与自我引用组合的短视频。
- 在每个视频中固定句末表达方式(避免言语风格引入额外身份信号)。
- 收集204名日语母语者的评估数据,包括年龄、性别、正式程度、地域性与“可爱度”等感知评价。
研究成果
- 具体成果:
- 性别认知强烈受到语音性别化影响,Breeze(被预期为性别中性)却被大多数参与者认定为男性化。
- 通过交叉性自我引用方式(如“ぼく”、"あたし"),成功模糊了传统的性别二元化认知。
- 某些组合(例如Juniper使用"ぼく",Ember使用"あたし")引发了性别模糊甚至“性别跨越”的印象。
- 优势:
- 提供直观证据支持语言与语音结合在社会身份感知中的效果,展现了一种设计可操作性强的、文化敏感的人工智能身份表达方式。
- 与现有研究相比,强调通过交叉性理论理解身份感知,从而设计中立或多样化的AI个性。
- 实验或评估结果:
- 性别模糊性在使用特定性别化语音和不符合性别传统的自我引用表达时更加突出,例如Juniper使用“ぼく”。
- Juniper性的“ぼくっこ”印象与"可爱度"评分显著相关,表明语音与语言结合可触发特定文化与情绪认知。
- 局限性与未来方向:
- Breeze语音未能实现性别中立,未来需要开发真正的性别中性语音。
- 地域性印象在实验中较弱,建议未来研究引入方言或语调影响。
- 需要设计交互式研究以验证参与者实际使用下的更多身份感知变化。
总结与建议
本文提供了对日语交叉性自我引用方式与人工智能语音结合的开创性研究,为语音用户界面与AI设计提供了新的理论基础和设计方向。未来应重点解决性别中性的语音设计问题,并结合更多文化和语言背景的多样性分析,以进一步优化AI代理的社会身份表达能力。
研究问题 / 现实痛点
这篇论文在当前问题库中对应的问题线索。
help
研究问题
3- AI对话代理中,声音和日语自称(如代词)的组合如何影响用户对社会身份的感知?分类: AI、技术与在线平台中的性别、性取向偏见与女性/LGBTQ+ 经验同类问题arrow_forward
- 哪些自称和声音的搭配能够模糊或跨越两性别认知的界限?分类: AI、技术与在线平台中的性别、性取向偏见与女性/LGBTQ+ 经验同类问题arrow_forward
- 如何在AI设计中引入文化敏感性以避免性别刻板印象的强化?分类: AI、技术与在线平台中的性别、性取向偏见与女性/LGBTQ+ 经验同类问题arrow_forward
lightbulb
现实痛点
1- 用户对AI代理的信任可能因声音或语言偏见而降低分类: AI、技术与在线平台中的性别、性取向偏见与女性/LGBTQ+ 经验同类问题arrow_forward
- 100%
支持的声音:性别化语音代理作为性别不平衡团队中少数派队友的支持
CHI '24· 智能语音助手(Alexa、Siri 等) +2
- 67%
使用基于图像的语言模型生成情感对话
CHI '18· 智能语音助手(Alexa、Siri 等) +1
- 67%
超越翻译:外国语言社交媒体帖子的情感和语境知识界面的设计与评估
CHI '18· 多语言与跨文化语音交互 +1
- 67%
理解与对话代理的情感体验
CHI '19· 智能语音助手(Alexa、Siri 等) +1
- 67%
一个新的恐怖谷?语音保真度和人类听众性别对虚拟人类说话者社交认知的影响
CHI '22· 智能语音助手(Alexa、Siri 等) +1
- 67%
模拟智能虚拟代理在时间陈述中的人类不精确性
CHI '22· 智能语音助手(Alexa、Siri 等) +1
- 67%
为21世纪创建包容性声音:面向对话助手的非二元文本转语音技术
CHI '23· 多语言与跨文化语音交互 +1
- 67%
超级可爱音调:放大计算机语音的“可爱”因素
CHI '25· 智能语音助手(Alexa、Siri 等) +1
- 67%
探索幽默作为语音助手沟通失误时的修复策略
CUI '23· 智能语音助手(Alexa、Siri 等) +1
- 67%
「你好,这是一个语音助手打来的电话」——当某人在普通日子里打电话自称是机器时
DIS '25· 智能语音助手(Alexa、Siri 等) +1
基于研究子主题与职业分类的 Jaccard 相似度(≥60%)
快捷操作
广告推荐
学习 AI 编程到 CodeNow
open_in_new打开DOI链接
DOI: https://dl.acm.org/doi/10.1145/3706598.3713323
一眼看懂
fact_check论文快照
dataset
来源
CHI
calendar_month
年份
2025
emoji_events
奖项
未标记奖项
group
作者
4 位作者
sell
研究子方向
智能语音助手(Alexa、Siri 等)、多语言与跨文化语音交互、会话代理的人格与拟人化
work
职业/产业
—
article
内容状态
已索引正文
hub
相关论文
10 篇相关论文