region-proposal

Tag

Cards List
#region-proposal

Region-Level Policy Optimization for Fine-grained MLLM Perception

Hugging Face Daily Papers · 4d ago Cached

Vision-RL² is a method for improving fine-grained perception in multimodal large language models by using region-level reinforcement learning to compress visual tokens and enhance performance across multiple benchmarks without full model fine-tuning.

0 favorites 0 likes
← Back to home

Submit Feedback