评估个性化价值对齐在人形机器人交互中的影响:信任与团队绩效成果的洞察
大语言模型(LLM)的人机协作社交机器人交互人-机器人协作(HRC)
本文研究了机器人实时个性化对齐其奖励函数与人类价值观对信任和团队绩效的影响。我们提出并比较了三种不同的机器人交互策略:非学习者策略(机器人假设人类的奖励函数与其自身相同);非适应性学习者策略(机器人学习人类的奖励函数用于信任估计和人类行为建模,但仍优化自身的奖励函数);适应性学习者策略(机器人学习人类的奖励函数并将其作为自己的奖励函数)。我们进行了两项人类受试者实验,共有54名参与者。在两个实验中,人机团队在城镇中搜索潜在威胁。团队依次经过搜索地点寻找威胁。我们将人与机器人之间的交互建模为信任感知的马尔可夫决策过程(信任感知MDP),并使用贝叶斯逆强化学习(IRL)来估计人类在与机器人交互过程中的奖励权重。在实验1中,我们使用人类价值观/目标的先验信息启动学习算法。在实验2中,我们使用无信息的先验启动学习算法。结果表明,当从良好的信息先验开始时,个性化适应价值观似乎不会使信任或团队绩效受益。另一方面,当信息先验不可用时,适应人类价值观会导致更高的信任和更高的感知绩效,同时保持相同的客观团队绩效。
研究问题 / 现实痛点
这篇论文在当前问题库中对应的问题线索。
当前问题库还没有收录这篇论文的问题与痛点。
- 67%
基于社会环境的机器人程序转换
CHI '20· 社交机器人交互 +1
- 67%
向服务机器人传达人类意图:理解面对面交谈中社交暗示的使用
CHI '25· 社交机器人交互 +1
- 67%
关爱是否导致纽带形成?探索人类对机器人关爱与人机纽带关系之间的关系
CHI '25· 社交机器人交互 +1
- 67%
可惩罚的人工智能:探究用户对机器人惩罚的态度
DIS '20· 社交机器人交互 +1
- 67%
肯定与否定机器人手势对人类群体成员感知人格、角色和贡献的影响
DIS '25· 社交机器人交互 +1
- 67%
非随机智能体:个性化服务机器人与多人的交互研究
HRI '20· 社交机器人交互 +1
- 67%
跟随我:类人外观与沟通对社会感知和联合导航行为的影响
HRI '24· 社交机器人交互 +1
- 67%
人机交互中初始遭遇的力量:机器人初始行为如何塑造后续交互
HRI '24· 社交机器人交互 +1
- 67%
人机交互的创作与验证
UIST '18· 社交机器人交互 +1
基于研究子主题与职业分类的 Jaccard 相似度(≥60%)
快捷操作
一眼看懂
fact_check论文快照
dataset
来源
HRI
calendar_month
年份
2024
emoji_events
奖项
未标记奖项
group
作者
4 位作者
sell
研究子方向
大语言模型(LLM)的人机协作、社交机器人交互、人-机器人协作(HRC)
work
职业/产业
—
article
内容状态
仅摘要
hub
相关论文
9 篇相关论文