golden-grpo

Tag

Cards List
#golden-grpo

From Memorization to Absorption: Mixed-Policy RL for Continual Knowledge Injection

arXiv cs.CL · 2026-08-27 Cached

This paper proposes Golden-GRPO Injection (GRIN), a mixed-policy reinforcement learning framework for continual knowledge injection in large language models, overcoming limitations of supervised fine-tuning. Experiments demonstrate superior performance on knowledge absorption benchmarks.

0 favorites 0 likes
← Back to home

Submit Feedback