标签
本文提出了一种基于近端策略优化(PPO)的深度强化学习框架,用于仓库中自主移动机器人的动态电池充电,与基线方法相比,最高可实现6%的订单完成率提升。
本文提出了一种多目标控制系统,利用差分进化和多智能体深度强化学习对奶牛场的电池进行管理,与基于规则的模型相比,能源套利利润最高可提高18%。
本文介绍了 C2L-Net,这是一种数据驱动模型,利用短历史窗口实现锂离子电池高效且准确的荷电状态(SOC)估计。