标签
FunL2O提出了一个统一框架,利用LLM驱动的程序演化来自动化学习优化方法中的特征函数设计,在连续和离散优化任务中均展现出优于人工设计特征的一致改进。
该论文介绍了MILP-Evo,这是一个闭环框架,利用LLM引导的程序进化来自动设计白盒MILP求解器组件(割选择器和分支规则),通过迭代生成和评估候选程序,并根据其在MILP实例上的端到端求解性能进行评估。
SMCEvolve 提出了一种原则性框架,用于 LLM 驱动的程序演化,通过将其重新表述为使用序贯蒙特卡洛从奖励倾斜分布中采样。它提供了收敛保证,并在多个科学发现基准测试中优于现有方法。