@TheTuringPost: 本周必读论文—— Harness Handbook: 让不断演化的智能体工具可读、可导航、可编辑 搜索…
摘要
本周必读论文精选,涵盖智能体系统、长上下文强化学习、视觉推理等。
查看缓存全文
缓存时间: 2026/07/21 18:47
本周必读论文
Harness 手册:让演化的智能体框架更可读、可导航、可编辑
SearchOS-V1
KnowAct-GUIClaw
LongStraw:固定 GPU 预算下超过 200 万 Token 的长上下文强化学习
SEED:面向智能体强化学习的自演化同策略知识蒸馏
DeepLoop:循环 Transformer 的深度扩展
RoboTTT:机器人策略的上下文扩展
UniVR:在视觉空间中思考以实现统一视觉推理
面向多步视觉推理的分层去噪
划分、提示、聚合:语言模型中的统计自一致性
从成功的流程中追溯智能体失败
现代智能体系统中的自我改进:综述
相似文章
Harness Handbook:使不断演化的智能体Harness可读、可导航、可编辑
Harness Handbook是一种以行为为中心的表示,通过静态程序分析和LLM辅助从智能体harness代码库中合成,帮助开发者和编码智能体定位实现特定行为的代码。它引入了行为引导的渐进式披露(BGPD),引导智能体从高层描述到相关实现细节,提高了定位准确性和编辑计划质量。
@dair_ai:本周顶级AI论文(5月31日-6月7日)——LEAP、AutoLab、从自身潜变量学习、可复用上下文工程……
本周(5月31日至6月7日)值得关注的AI研究论文摘要,包括LEAP、AutoLab以及智能体框架的扩展定律等。
@fullstackpython: 最近我很喜欢学习的一些关于约束工程的资源:* https://walkinglabs.github.io/lear…
一份精心整理的关于人工智能编码代理的约束工程资源合集,包括一个课程、一个Python工具(tau-ai)、以及来自Anthropic和LangChain的博客文章。
@TheTuringPost:本周必读研究 Harness-1:基于状态外化束带的搜索智能体的强化学习 R…
本文探讨了大型语言模型中持续学习的复兴,强调了离线整合(即“睡眠”)的必要性,以防止灾难性遗忘,并使模型在部署后能够保持更新和专业化。
@loganthorneloe: https://x.com/loganthorneloe/status/2075684831233757275
本周精选五篇值得关注的AI文章,涵盖自我改进代理、Bun向Rust迁移、vLLM架构、编码评估基准以及代理自主性等级。