policy-interpretability

标签

Cards List
#policy-interpretability

通过归纳逻辑编程解释强化学习智能体

arXiv cs.AI · 2026-07-16 缓存

本文引入归纳逻辑编程来提取强化学习策略的符号化表示,并提出了新颖的可解释性度量(激活率、特征覆盖度、语法距离和语义距离),用于在单智能体和多智能体设置中进行客观评估。

0 人收藏 0 人点赞
← 返回首页

提交意见反馈