信念空间动力学中可容许学习率步长的闭式上界

Hugging Face Daily Papers 论文

摘要

本文提出了信念空间动力学中可容许学习率步长的闭式上界,为机器人或控制领域的优化提供了理论结果。

学习率步长通常被视为超参数。本文独立了一种局部信念空间计算:当更新被建模为概率单纯形上的投影前向步时,可容许性意味着在自然KL/Bregman几何下的收缩性。在此模型下,可容许步长的上界不是一个调参口号,而是一个公式。
查看原文
查看缓存全文

缓存时间: 2026/05/12 14:52

论文页面 - 信念空间动力学中可容许学习率步长的闭式上界

来源: https://huggingface.co/papers/2605.06741 在您的智能体中获取此论文:

hf papers read 2605\.06741

没有最新的CLI?curl \-LsSf https://hf\.co/cli/install\.sh \| bash

引用此论文的模型0

暂无模型关联此论文

请在模型 README.md 中引用 arxiv.org/abs/2605.06741 以链接到此页面。

引用此论文的数据集0

暂无数据集关联此论文

请在数据集 README.md 中引用 arxiv.org/abs/2605.06741 以链接到此页面。

引用此论文的 Space0

暂无 Space 关联此论文

请在 Space README.md 中引用 arxiv.org/abs/2605.06741 以链接到此页面。

包含此论文的收藏集0

暂无收藏集包含此论文

请将本论文添加到一个收藏集 (https://huggingface.co/new-collection) 中以在此页面链接。

相似文章

调整速度作为非平稳强化学习的安全约束

arXiv cs.LG

本文提出将调整速度作为非平稳强化学习的安全约束,从适应可行性角度定义安全性,并利用表示学习与上下文预测,在预测的适应需求超过系统可达容量时主动调节行为。