entropy-regularized

标签

Cards List
#entropy-regularized

机制切换扩散模型中线性二次Stackelberg微分博弈的熵正则化强化学习方法

arXiv cs.LG · 2026-06-30 缓存

本文提出了一种熵正则化强化学习方法,用于解决机制切换扩散模型中的线性二次Stackelberg微分博弈,通过集成神经网络来近似价值函数并逃离次优均衡。

0 人收藏 0 人点赞
← 返回首页

提交意见反馈