@HaiyuWu1:- 论文分享 LeWM 现在可以处理多任务了!怎么做?将正则化损失(例如 SIGReg 和 VISReg)应用于时间…
摘要
一篇论文介绍了 TC-LeWM,将 SIGReg 和 VISReg 等正则化损失应用于时间潜在残差,使 LeWM 能够进行多任务学习,显著提高了 LIBERO 机械臂基准上的成功率。
查看缓存全文
缓存时间: 2026/08/14 03:28
- 论文分享
LeWM 现在可以处理多任务了!
怎么做?对时间潜在残差应用正则化损失(例如 SIGReg 和 VISReg),仅此而已!
这个设计背后的原理相当有见地: 来自多个任务的样本应该共享同一个潜在空间,但不应该被强制到相同的分布。
这篇论文表明,直接调节编码后的时间嵌入会破坏每个任务应保留的分布。
他们在 LIBERO 数据集上跨 10 个任务对比了该方法。结果非常强劲: Raw LeWM — 44.4 TC-LeWM — 73.5 (+29.1) 平均而言,TC-LeWM 显著提高了这些任务上的成功率。
我的想法: 这个方法解决的问题比他们声称的更多。抓取(Gripping)对于 Raw LeWM 来说是一个众所周知的困难规划问题,但 TC-LeWM 在这个机械臂数据集上显著提高了成功率。他们的方法更关注转移状态中的实际差异,从而放大了动作的重要性。
相似文章
@dair_ai: 新论文:让LLM智能体获得经验,同时改进权重并保持可读性。智能体经验…
JERP 提出了一种方法,让LLM智能体从相同的交互轨迹中联合学习可解释的自然语言规则并更新策略参数,在AlfWorld和WebShop上提升了性能,同时保持了可检查性。
LeWorldModel:从像素出发的稳定端到端联合嵌入预测架构
LeWorldModel 提出了一种稳定的端到端联合嵌入预测架构(JEPA),可直接从像素进行训练,仅需极少超参数,并具有可证明的反坍塌保证。与基础模型相比,它在规划速度上实现了显著提升,同时在机器人操作任务中保持了具有竞争力的性能。
LeRobot v0.6.0: 想象、评估、改进
LeRobot v0.6.0 是 Hugging Face 机器人学习库的一个重要版本,新增世界模型策略(VLA-JEPA、FastWAM、LingBot-VA)、新的 VLAs、奖励模型、六个模拟基准、深度感知、基于 VLM 的数据集注释、自定义视频编码、云端训练,以及用于人工在环校正的部署 CLI。
Fast LeWorldModel
Fast-LeWM 通过并行动作前缀预测替代自回归展开,加速视觉规划,减少长期预测中的计算成本和延迟累积。
通过参数化记忆扩展自进化智能体
来自阿里巴巴/Qwen和北京大学的研究人员提出了TMEM——一种自进化参数化记忆框架。该框架利用在线LoRA权重更新,使LLM智能体能够在单个回合内真正从经验中学习,而非仅依赖提示空间中的记忆。TMEM在多个基准测试(包括LoCoMo、LongMemEval-S和CL-Bench)上均优于基于摘要和基于检索的基线方法。