dynamic-policies

标签

Cards List
#dynamic-policies

实时智能:环境驱动的动态策略助力持续LLM改进

arXiv cs.CL ↗ · 2026-09-16 缓存

本文提出动态检索策略生成(DRPG)框架,该框架利用记忆检索和环境反馈动态生成策略,以在多种任务中实现大型语言模型的持续改进。

0 人收藏 0 人点赞
← 返回首页

提交意见反馈