policy-generation

Tag

Cards List
#policy-generation

Smarter by the Moment: Environment-Driven Dynamic Policies for Continual LLM Improvement

arXiv cs.CL ↗ · 2026-09-16 Cached

This paper proposes Dynamic Retrieval-based Policy Generation (DRPG), a framework that uses memory retrieval and environment feedback to dynamically generate policies for continual improvement of large language models across various tasks.

0 favorites 0 likes
← Back to home

Submit Feedback