基于检索增强搜索的LLM程序优化
摘要
本文提出了检索增强搜索(RAS),一种黑盒自适应方法,利用检索增强搜索和原子编辑分解(AEGIS)来改进基于LLM的C++和Python程序优化,相较于先前方法实现了高达2.06倍的提升。
查看缓存全文
缓存时间: 2026/06/30 19:37
论文页面 - 基于检索增强搜索的 LLM 程序优化
来源:https://huggingface.co/papers/2501.18916
摘要
使用检索增强搜索和原子编辑分解的黑盒适配方法,可同时提升 C++ 和 Python 代码的程序优化性能。
近期研究已展示了大型语言模型(LLM)在程序优化(编程语言领域的关键挑战)方面的潜力。我们提出了一种名为检索增强搜索(RAS)的黑盒适配方法,该方法对候选优化方案执行束搜索;在每一步中,它会从给定的慢速-快速程序对训练数据集中检索上下文示例,以引导 LLM。关键的是,我们发现基于 LLM 生成的自然语言描述进行上下文检索,其效果显著优于基于源代码的检索。我们还提出了 AEGIS,一种通过将训练示例分解为本质上更渐进的“原子编辑”来提高可解释性的方法。我们证明,在优化 C++ 程序方面,RAS 的表现比先前最先进的黑盒适配策略高出 2.06 倍;而 AEGIS 在做出显著更小编辑的同时,性能提升可达 1.37 倍。我们还表明,使用 RAS 可将 Python 程序的平均运行时间百分位数比基线提高 10.27。
查看 arXiv 页面 (https://arxiv.org/abs/2501.18916) 查看 PDF (https://arxiv.org/pdf/2501.18916) 项目页面 (https://sagnikanupam.com/papers/llmprogramoptimization/index.html) GitHub2 (https://github.com/sagnikanupam/llmprogramoptimization) 添加到收藏 (https://huggingface.co/login?next=%2Fpapers%2F2501.18916)
在你的代理中获取该论文:
hf papers read 2501\.18916
没有最新的 CLI?curl \-LsSf https://hf\.co/cli/install\.sh \| bash
引用此论文的模型0
无模型链接至本论文
请在模型 README.md 中引用 arxiv.org/abs/2501.18916,以便从此页面链接。
引用此论文的数据集0
无数据集链接至本论文
请在数据集 README.md 中引用 arxiv.org/abs/2501.18916,以便从此页面链接。
引用此论文的 Spaces0
无 Space 链接至本论文
请在 Space README.md 中引用 arxiv.org/abs/2501.18916,以便从此页面链接。
包含此论文的收藏集0
无收藏集包含本论文
请将本论文添加到一个收藏集 (https://huggingface.co/new-collection) 中,以便从此页面链接。
相似文章
RASC+: 面向临床值集编制的检索约束型大语言模型裁决方法
本文介绍了RASC+,一种用于临床值集编制的检索约束型大语言模型裁决方法,其通过基于Qwen3的检索和盲目裁决,提升了候选集召回率和选择精度,显著优于RASC基线中的直接生成方法。
HPC-LLM:面向HPC支持的实用领域自适应与检索增强生成
本文介绍了HPC-LLM,一个面向HPC工作流的检索增强与领域自适应助手,基于HPC文档使用QLoRA微调Llama 3.1 8B模型。实验表明,该模型在资源需求显著降低的情况下,性能与更大的通用模型相当。
从自适应列表排序角度重新审视自适应检索增强生成的必要性
本文提出了 AdaRankLLM,一个自适应检索框架,通过列表排序动态过滤检索到的段落,对自适应 RAG 的必要性提出质疑。研究表明自适应检索对于较弱模型充当噪声过滤器,对于更强模型充当成本效率优化器,在多个数据集和 LLM 上进行了广泛实验。
通过异构编辑重组克服LLM驱动程序优化中的最薄弱环节效应
介绍了HERO,一种基于LLM的程序优化器,通过生成并重组异构原子编辑来克服最薄弱环节效应,在算法、游戏、智能体及机器人等领域实现更快的收敛速度和更高的分数。
基于LLM的嵌入用于程序分析与优化
本文介绍了LLMCompiler(一个在IR代码上大规模预训练的LLM)产生的程序嵌入在程序分析和优化任务中的首次应用,在算法分类中实现了1.54%的错误率,并在异构设备映射上取得了有竞争力的准确率。