@shawntenam:GEPA(http://github.com/gepa-ai/gepa)通过自动优化提示指令,把 Haiku 4.5 的通过率从 65% 提升到 85%
摘要
GEPA 是一款开源工具,可基于执行轨迹和评分自动优化提示指令,无需更换模型,就能将 Claude Haiku 4.5 的通过率从 65% 提升到 85%。
GEPA(http://github.com/gepa-ai/gepa)通过结合执行轨迹与评分,自动优化我的提示指令,将 Haiku 4.5 的通过率从 65% 提升到 85%。它就像针对 CLAUDE.md 文件的精准提示调优,无需更换模型。开发者们,赶紧拿去跑一把。
相似文章
FAPO: 多步骤LLM流水线的全自动提示优化
FAPO是一个用于多步骤LLM流水线的全自动提示优化框架,结合了提示编辑和结构变化。在18次对比中,它在15次中优于GEPA基线,在安全任务上收益高达+33.8个百分点。
GEPA:反思式提示演化可超越强化学习
GEPA 是一款提示优化器,利用自然语言反思从试错中学习,在多个任务中,以多达 35 倍的更少 rollout 次数超越了 GRPO 和 MIPROv2 等强化学习方法。
@harold_matmul: 这是我的主意 :) 使用GEPA创建LLM程序是一种非常自然的工作流。迭代速度非常快,……
用户感谢GEPA工具,强调其为LLM程序提供了自然的工作流、快速的迭代速度,以及利用数据-derived priors偏置优化的能力。
@leanxbt: https://x.com/leanxbt/status/2070852461494202609
一篇详细介绍Loop Prompt Engineering的文章,这是一种通过基于数据集评估迭代重写提示来自动化提示优化的方法,重点强调避免递归陷阱。
@harold_matmul: dspy.GEPA 用于新微软AI工作中的预训练数据筛选 :-)
本文解释了DSPy中的GEPA(基因-帕累托优化)如何用于高效的提示调优,特别是在微软AI的预训练数据筛选中应用,使研究人员能够用自动化的计算驱动优化取代手动提示工程。