fine-grained-reinforcement-learning

标签

Cards List
#fine-grained-reinforcement-learning

ContextPilot-14B(Hugging Face 仓库)

TLDR AI · 2026-08-31 缓存

ContextPilot-14B 是一个 Qwen3-14B 检查点,它通过细粒度强化学习教授语言模型智能体主动上下文管理,以应对长期任务。

0 人收藏 0 人点赞
← 返回首页

提交意见反馈