llm-improvement

Tag

Cards List
#llm-improvement

Harness-Zero: Harness Distillation via Agent-as-Harness

Hugging Face Daily Papers · 2d ago Cached

This paper introduces Harness-Zero, a method for distilling optimized agent harnesses into large language models via agent-as-harness, significantly boosting task performance in knowledge work, tool use, and science domains even after specialized harnesses are removed.

0 favorites 0 likes
#llm-improvement

CriticGen: Generation-Aware Evaluation as Actionable Feedback

arXiv cs.AI · 2026-09-10 Cached

CriticGen is a fine-grained, generation-aware evaluation framework for large language models that generates sample-specific evaluation criteria to provide actionable feedback for improving answer quality.

0 favorites 0 likes
← Back to home

Submit Feedback