用于RL训练机器人表现性用户控制的在线行为修改
作者
AI 辅助决策与自动化系统人-机器人协作(HRC)AI/ML 研究员与工程师HCI 研究员
强化学习(RL)是机器人学习任务的有效方法。然而,在典型的RL中,机器人在部署后终端用户几乎无法控制机器人完成任务的方式。为解决这一问题,我们引入了在线行为修改的概念——一种用户可在机器人使用RL训练策略自主完成任务时实时控制机器人行为特征的范式。为了展示这种以用户为中心的公式化方法在人机交互中的价值,我们提出了一种基于行为多样性的算法——RL动态可调控制(ACORD),并展示了其在模拟和用户研究中在线行为修改的适用性。在研究中(n=23),用户在机器人自主描绘形状时调整绘画风格。我们将ACORD与RL和共享自主性(SA)进行了比较,表明ACORD提供了用户优选的表达控制水平,与SA相当,但具有自主执行和RL鲁棒性的潜力。
研究问题 / 现实痛点
这篇论文在当前问题库中对应的问题线索。
当前问题库还没有收录这篇论文的问题与痛点。
- 100%
对齐人类与机器人表征
HRI '24· AI 辅助决策与自动化系统 +1
- 80%
REX:设计以用户为中心的修复和解释以应对机器人故障
DIS '24· 可解释人工智能(XAI) +2
- 80%
通过控制屏障函数屏蔽增强学习演示算法的安全性
HRI '24· AI 辅助决策与自动化系统 +1
- 67%
《应该信任你还是信任人工智能?》——混合人机团队中领导者的信任与感知研究
CHI '26· 人-机器人协作(HRC) +2
- 67%
朋友、敌人还是机器人?探索混合人机团队中的群体动力学
CHI '26· 人-机器人协作(HRC) +2
- 60%
人类与AI交互中沟通方向性和AI代理差异的影响
CHI '21· 大语言模型(LLM)的人机协作 +1
- 60%
整体是否超过其部分?AI解释对互补团队绩效的影响
CHI '21· 可解释人工智能(XAI) +1
- 60%
两个脑袋比一个好:一个统一共享控制中人类和人工智能的维度空间
CHI '22· AI 辅助决策与自动化系统 +1
- 60%
模型草图:在机器学习模型早期设计中关注概念
CHI '23· AI 辅助决策与自动化系统 +1
- 60%
匹配思维与方法:基于调节模式理论的数字伴侣增强决策
CHI '23· AI 辅助决策与自动化系统
基于研究子主题与职业分类的 Jaccard 相似度(≥60%)
快捷操作
一眼看懂
fact_check论文快照
dataset
来源
HRI
calendar_month
年份
2024
emoji_events
奖项
未标记奖项
group
作者
5 位作者
sell
研究子方向
AI 辅助决策与自动化系统、人-机器人协作(HRC)
work
职业/产业
AI/ML 研究员与工程师、HCI 研究员
article
内容状态
仅摘要
hub
相关论文
10 篇相关论文