execution-feedback

标签

Cards List
#execution-feedback

@leanxbt: 这篇论文完全改变了我对一个智能体如何修复自身代码的看法:生成代码 -> 执行 -> 解释...

X AI KOLs Timeline · 2026-07-10 缓存

本文介绍了一种自我调试技术,智能体通过迭代生成、执行和解释自身代码来发现错误,无需错误信息,准确率提升高达12%,并与生成10倍候选方案的基线持平。

0 人收藏 0 人点赞
#execution-feedback

EXPO-SQL:基于执行的子句级策略优化用于Text-to-SQL

arXiv cs.CL · 2026-06-24 缓存

EXPO-SQL 提出了一种细粒度的子句级策略优化方法用于 Text-to-SQL,通过执行反馈为每个子句而不是每个查询分配奖励,显著提升了性能,优于现有的监督微调和强化学习方法。

0 人收藏 0 人点赞
#execution-feedback

Evoflux: 针对轻量级智能体的可执行工具工作流的推理时演化

Hugging Face Daily Papers · 2026-06-10 缓存

Evoflux 在推理时使用进化搜索来修复轻量级语言模型中失败的工具工作流,相比微调方法显著提升了执行可行性。

0 人收藏 0 人点赞
#execution-feedback

从执行结果自举文本到SQL的语义层

arXiv cs.CL · 2026-06-05 缓存

介绍GATE(从执行结果中测试后接地)方法,该方法从执行反馈中自举缺失的语义接地,以处理文本到SQL任务中未明确指定的用户短语,持续提升超越强基线。

0 人收藏 0 人点赞
#execution-feedback

CP-Agent:一种用于反馈驱动型竞赛编程的校准风险控制代理

arXiv cs.CL · 2026-05-26 缓存

CP-Agent 提出了一种借助大型语言模型的校准风险控制方法,用于反馈驱动型竞赛编程,无需参数更新即可在基准测试上取得显著改进。

0 人收藏 0 人点赞
← 返回首页

提交意见反馈