function-level-feedback

Tag

Cards List
#function-level-feedback

Function-Level Execution Feedback for Code Preference Optimization

arXiv cs.AI · 2026-08-26 Cached

This paper proposes Step-KTOder, a framework for code preference optimization that uses function-level execution feedback with unit tests to improve over outcome-only methods like KTO and DPO on benchmarks such as HumanEval+ and MBPP+.

0 favorites 0 likes
← Back to home

Submit Feedback