@TheTuringPost: 本周必读论文—— Harness Handbook: 让不断演化的智能体工具可读、可导航、可编辑 搜索…

X AI KOLs Timeline 论文

摘要

本周必读论文精选,涵盖智能体系统、长上下文强化学习、视觉推理等。

本周必读论文 Harness Handbook: Making Evolving Agent Harnesses Readable, Navigable, and Editable SearchOS-V1 KnowAct-GUIClaw LongStraw: 在固定GPU预算下超越200万令牌的长上下文强化学习 SEED: 针对智能体强化学习的自进化同策略蒸馏 DeepLoop: 循环变压器的深度缩放 RoboTTT: 机器人策略的上下文缩放 UniVR: 在视觉空间中思考以实现统一视觉推理 多步视觉推理的分层去噪 分区、提示、聚合:语言模型中的统计自一致性 从成功流中追溯智能体失败 现代智能体系统中的自我改进:综述
查看原文
查看缓存全文

缓存时间: 2026/07/21 18:47

本周必读论文

Harness 手册:让演化的智能体框架更可读、可导航、可编辑
SearchOS-V1
KnowAct-GUIClaw
LongStraw:固定 GPU 预算下超过 200 万 Token 的长上下文强化学习
SEED:面向智能体强化学习的自演化同策略知识蒸馏
DeepLoop:循环 Transformer 的深度扩展
RoboTTT:机器人策略的上下文扩展
UniVR:在视觉空间中思考以实现统一视觉推理
面向多步视觉推理的分层去噪
划分、提示、聚合:语言模型中的统计自一致性
从成功的流程中追溯智能体失败
现代智能体系统中的自我改进:综述

相似文章

Harness Handbook:使不断演化的智能体Harness可读、可导航、可编辑

arXiv cs.AI

Harness Handbook是一种以行为为中心的表示,通过静态程序分析和LLM辅助从智能体harness代码库中合成,帮助开发者和编码智能体定位实现特定行为的代码。它引入了行为引导的渐进式披露(BGPD),引导智能体从高层描述到相关实现细节,提高了定位准确性和编辑计划质量。