标签
本文提出了一种面向军事资产分配的场景加权对抗鲁棒态势优化引擎,提出了CEV和RobustCEV优化器,在对抗性威胁不确定性下优于贪婪基线方法。
介绍Age of LLM,一个回合制1v1基准测试,LLM在带有战争迷雾和外交机制的网格上对战,评估推理、可靠性和战略规划能力。结果显示核速攻战术占主导,且可靠性与获胜之间存在弱关联。