differentiable-rewards

Tag

Cards List
#differentiable-rewards

VLMs are Good Teachers for Video Reasoning via Adaptive Test-Time Optimization

Hugging Face Daily Papers · 2026-06-01 Cached

This paper introduces a paradigm where Vision-Language Models (VLMs) act as test-time teachers to guide Video Generation Models (VGMs) via differentiable rewards and LoRA optimization, achieving a 16.7-point average improvement on video reasoning benchmarks.

0 favorites 0 likes
← Back to home

Submit Feedback