llm-improvement

标签

Cards List
#llm-improvement

Harness-Zero:通过Agent-as-Harness的Harness蒸馏

Hugging Face Daily Papers · 2天前 缓存

本文介绍了Harness-Zero,一种通过agent-as-harness将优化的代理框架蒸馏到大语言模型中的方法,即使在专业框架被移除后,也能显著提升知识工作、工具使用和科学领域的任务性能。

0 人收藏 0 人点赞
#llm-improvement

CriticGen:生成感知评估作为可操作反馈

arXiv cs.AI · 2026-09-10 缓存

CriticGen 是一个细粒度、生成感知的评估框架,适用于大型语言模型,它生成特定样本的评估标准,以提供可操作的反馈来提高答案质量。

0 人收藏 0 人点赞
← 返回首页

提交意见反馈