在地质、需求与定价不确定性下优化锂生产决策:面向多目标决策的POMDP框架
摘要
本文提出了一种面向锂生产多目标决策的POMDP框架,处理地质、需求与定价不确定性,以优化矿山开采及提取方法选择。该方法通过信念状态规划动态适应价格机制变化,优于基于人类启发式的方法。
arXiv:2606.18598v1 公告类型:新
摘要:锂生产中的决策制定具有挑战性,无论从投资者角度还是战略生产角度。确定开采哪些矿山以及何时开采不仅涉及地质和价格不确定性,还涉及提取方法选择的复杂性,从直接提锂到硬岩开采。先前的研究探索了该问题的模型以及优化采矿决策的不同方法;这些模型未考虑定价不确定性、需求不确定性或提取锂的不同采矿技术。将不同的定价模型和提取技术纳入这些模型,可以制定更稳健的策略,不仅决定何时何地开矿,还决定采用哪种生产方式。我们将问题建模为部分可观测马尔可夫决策过程(POMDP),并使用信念状态规划方法求解,以获得最优决策。在我们的研究中,我们展示了POMDP求解器通过信念状态规划和显式不确定性管理,动态适应锂价格机制(静态、线性、指数和随机)的变化,从而优于人类启发式方法。通过优化探索、生产和技术选择的顺序,该框架在所有不同的定价和矿床场景下,在项目生命周期内实现了更高的需求满足度和更平衡的经济环境成果。
查看缓存全文
缓存时间: 2026/06/18 05:40
# 在地质、需求和定价不确定性下优化锂生产决策:面向多目标决策的POMDP框架 来源:https://arxiv.org/abs/2606.18598 查看 PDF (https://arxiv.org/pdf/2606.18598) > 摘要:锂生产中的决策充满挑战,无论是从投资者角度还是从战略生产角度而言。决定开采哪些矿场以及何时开采,不仅涉及地质和价格不确定性,还涉及提取方法选择上的复杂性——从直接锂提取到硬岩开采。先前的工作探索了该问题的模型以及优化采矿决策的不同方法;但这些模型未考虑定价不确定性、需求不确定性或提取锂的不同采矿技术。将不同的定价模型和提取技术纳入这些模型,可以制定更稳健的策略,不仅确定何时何地开矿,还能确定采用哪种生产方法。我们将该问题构建为部分可观察马尔可夫决策过程(POMDP),并使用信念状态规划方法求解以得到最优决策。在我们的研究中,我们展示了POMDP求解器通过信念状态规划和显式的不确定性管理,能够动态适应变化的锂价体制(静态、线性、指数和随机),从而超越人类启发的启发式方法。通过优化勘探、生产和技术选择的顺序,该框架在所有不同定价和矿床场景下,在项目生命周期内实现了更高的需求满足度以及更均衡的经济环境结果。 ## 提交历史 来自:Anna Edmonds [查看邮箱](https://arxiv.org/show-email/72231850/2606.18598) **[v1]** 2026年6月17日星期三 01:49:09 UTC (926 KB)
相似文章
不确定性下的决策驱动地质导向:一种用于序贯决策优化的统一框架
提出了一种不确定性感知的地质导向框架,该框架将用于概率地下解释的粒子滤波与用于序贯决策的强化学习相结合,并在工业模拟器上进行了评估。
Sim2Schedule:一种模拟器引导的LLM框架,用于自主露天矿调度
本文介绍Sim2Schedule,一种由模拟器引导的LLM框架,用于自主露天矿调度。该框架在计算时间线性扩展的情况下,能达到MILP最优净现值的94%-99%,且无需微调即可零样本运行。
深度强化学习用于自主订单拣选机器人的动态电池管理
本文提出了一种基于近端策略优化(PPO)的深度强化学习框架,用于仓库中自主移动机器人的动态电池充电,与基线方法相比,最高可实现6%的订单完成率提升。
Multi-Agent Deep Reinforcement Learning 用于奶牛场多目标电池管理
本文提出了一种多目标控制系统,利用差分进化和多智能体深度强化学习对奶牛场的电池进行管理,与基于规则的模型相比,能源套利利润最高可提高18%。
上下文收集决策过程:用于智能体搜索的POMDP框架
本文引入了上下文收集决策过程(CGDP),这是一个用于建模LLM智能体搜索行为的POMDP框架,提出了能够提升多跳推理能力并降低Token消耗且不影响性能的干预措施。