expert-demonstrations

标签

Cards List
#expert-demonstrations

利用逆强化学习进行多目标约束推断

arXiv cs.AI · 2026-05-11 缓存

本文介绍了 MOCI,这是一种新颖的框架,能够从强化学习中的异构专家演示中推断共享约束和个体偏好,在预测性能和计算效率方面均优于现有基线。

0 人收藏 0 人点赞
← 返回首页

提交意见反馈