用用户输入建模人类反馈的变异性:一项探索性方法论
AI 辅助决策与自动化系统心理健康应用与在线支持社区AI/ML 研究员与工程师HCI 研究员
为加速交互式强化学习(IntRL)算法的开发,先前工作常使用完美的Oracle作为模拟人类教师来提供反馈信号。这些Oracle通常源自真实知识或最优策略,在没有延迟的情况下向机器人学习者提供密集且无错误的反馈。然而,这种机器式反馈行为无法准确代表人类反馈的多样模式,可能导致真实人机交互中算法性能不稳定或出现意外。为缓解Oracle过度简化用户行为的这一局限性,我们提出一种可应用于标准Oracle的人类反馈变异性建模方法。我们提出了一个五维模型,包含先前工作中识别的五个反馈变异性维度。该模型能够修改完美Oracle的反馈输出,引入更多类似人类的特征。我们通过仿真实验展示每个模型属性如何影响IntRL算法的学习性能。我们还进行了概念验证研究,以两种方式说明如何从人群中获取模型数据。建模结果直观呈现了参与者的反馈变异性,有助于解释Oracle与人类教师之间的不匹配。总体而言,我们的方法是结合真实用户洞察改进模拟Oracle的有前景的一步。
研究问题 / 现实痛点
这篇论文在当前问题库中对应的问题线索。
当前问题库还没有收录这篇论文的问题与痛点。
- 60%
人类与AI交互中沟通方向性和AI代理差异的影响
CHI '21· 大语言模型(LLM)的人机协作 +1
- 60%
整体是否超过其部分?AI解释对互补团队绩效的影响
CHI '21· 可解释人工智能(XAI) +1
- 60%
模型草图:在机器学习模型早期设计中关注概念
CHI '23· AI 辅助决策与自动化系统 +1
- 60%
匹配思维与方法:基于调节模式理论的数字伴侣增强决策
CHI '23· AI 辅助决策与自动化系统
- 60%
一种人工智能并不适合所有人:关于普通人对人工智能角色认知的聚类分析
CHI '23· 可解释人工智能(XAI) +1
- 60%
人工智能知识:通过人类赋能提升人工智能委托
CHI '23· 大语言模型(LLM)的人机协作 +1
- 60%
"帮助我帮助AI": 理解可解释性如何支持人机交互
CHI '23· 可解释人工智能(XAI) +1
- 60%
迈向人机审议:设计和评估用于AI辅助决策的LLM增强审议AI
CHI '25· 大语言模型(LLM)的人机协作 +1
- 60%
可编辑XAI:面向可解释属性的双向人机对齐与协同可编辑解释
CHI '26· 可解释人工智能(XAI) +1
- 60%
涌现而非固有:巴拉德式的可解释人工智能解读
CHI '26· 可解释人工智能(XAI) +1
基于研究子主题与职业分类的 Jaccard 相似度(≥60%)
快捷操作
一眼看懂
fact_check论文快照
dataset
来源
HRI
calendar_month
年份
2024
emoji_events
奖项
未标记奖项
group
作者
3 位作者
sell
研究子方向
AI 辅助决策与自动化系统、心理健康应用与在线支持社区
work
职业/产业
AI/ML 研究员与工程师、HCI 研究员
article
内容状态
仅摘要
hub
相关论文
10 篇相关论文