stepwise-feedback

Tag

Cards List
#stepwise-feedback

STRIDE: Learnable Stepwise Language Feedback for LLM Reasoning

arXiv cs.LG · 2026-05-20

STRIDE introduces a training framework that uses learnable stepwise language feedback instead of scalar rewards to improve LLM reasoning, achieving state-of-the-art results on diverse benchmarks.

0 favorites 0 likes
← Back to home

Submit Feedback