标签
本文介绍了 RL4F,一个用于核聚变等离子体控制的离线强化学习基准测试,提供了闭环评估环境和基于 DIII-D 真实托卡马克数据的四个剖面跟踪任务的基线比较。代码库和数据集已开源,以促进进一步研究。
DeepMind 宣布与 Commonwealth Fusion Systems 建立研究合作伙伴关系,利用深度强化学习和 TORAX 等离子体模拟器来优化 SPARC 托卡马克的性能,加速实现净聚变能源的目标。