agent-harness

标签

Cards List
#agent-harness

@omarsar0: 构建并拥有你的工具,各位。很少有人理解定制和优化智能体工具背后的魔力…

X AI KOLs Following ↗ · 2026-09-11 缓存

该推文强调构建自定义AI智能体工具以优化性能,提到了Pi的应用,并讨论了自我改进算法和本地模型,以实现更好的控制和效率。

0 人收藏 0 人点赞
#agent-harness

Salesforce 发现了更好的方法来共同进化代理及其控制机制(9分钟阅读)

TLDR AI ↗ · 2026-09-11 缓存

这项研究探讨了将框架进化与模型适应相结合用于AI代理,发现直接模仿专家会损害较弱模型的性能,并提出了一种基于策略的纠正方法,以在不破坏框架适应企业任务的情况下提高性能。

0 人收藏 0 人点赞
#agent-harness

@0xZenad:最佳智能体升级方案或许并非新模型

X AI KOLs Timeline ↗ · 2026-09-09 缓存

文章指出,升级AI智能体或许应借助特定工具与仓库而非全新模型,并重点介绍了10个可优化上下文、记忆、工具与验证机制的GitHub项目。

0 人收藏 0 人点赞
#agent-harness

协同演化辅助框架与模型:在线策略校正助力弱模型在模仿失败时追赶

Hugging Face Daily Papers ↗ · 2026-09-08 缓存

本文提出一种在线策略专家校正流程,用于协同演化辅助框架与模型,使弱AI模型能通过纠正失败回合而非完全模仿来改进,保持兼容性并提升企业代理任务性能。

0 人收藏 0 人点赞
#agent-harness

hip-agent:适配于提示词中的框架(5分钟阅读)

TLDR AI ↗ · 2026-09-08 缓存

hip-agent 是一个极简的代理框架,适配于提示词中,允许AI模型使用简单的工具(如shell命令和现有协议)来读取和调整自己的框架。它被设计为可修复的,并适用于子代理任务。

0 人收藏 0 人点赞
#agent-harness

EVOHARNESSBENCH: 你的代理能否跟上不断演进的框架?

Hugging Face Daily Papers ↗ · 2026-09-03 缓存

本文介绍了EVOHARNESSBENCH,一个用于评估在工具、技能和代理框架不断演进下的LLM代理的基准测试,揭示了在保持和适应方面的差距。

0 人收藏 0 人点赞
#agent-harness

如何构建可靠的代理工具框架(阅读约48分钟)

TLDR AI ↗ · 2026-09-03 缓存

这篇文章作为构建可靠代理工具框架的事后分析和指南,详细介绍了从omp到omp²的架构经验教训,并倡导有效管理复杂性的设计原则。

0 人收藏 0 人点赞
#agent-harness

编码代理是否缺少架构层?我构建了一个开源代理工具来实验这一想法

Reddit r/AI_Agents ↗ · 2026-09-02

一位开发者实验了在编码代理中加入显式架构层的概念,构建了一个开源代理工具来测试该想法,并探讨了代理设计中的潜在权衡。

0 人收藏 0 人点赞
#agent-harness

HarnessDev:LLMs能否创建并演化其自身的代理执行框架?

Hugging Face Daily Papers ↗ · 2026-09-01 缓存

HarnessDev通过评估LLMs构建和演化执行框架的能力,揭示了模型间性能的显著差异以及较差的迁移性。

0 人收藏 0 人点赞
#agent-harness

@crazydonkey200: 很高兴其他用户发现 Amplio 很有帮助。这是我们用于自主长期研究运行的主要工具,持续时间为数天至……

X AI KOLs Timeline ↗ · 2026-08-28 缓存

Amplio 是一个由 Google DeepMind 开源的轻量级、健壮的代理工具,用于自主长期 AI 研究运行,具有崩溃恢复功能和简单的步骤模型。

0 人收藏 0 人点赞
#agent-harness

@omarsar0:又一篇好论文。关于代理工具箱的益处这一发现很有趣。

X AI KOLs Following ↗ · 2026-08-27 缓存

一篇论文探讨了代理工具箱与模型对代理行为的贡献差异,将轨迹压缩成一个紧凑的有限状态机,并在十二个数据集上进行了验证。

0 人收藏 0 人点赞
#agent-harness

@Saboo_Shubham_: 这就是方法...Agent Harness的推测性程序化工具调用。当LLM流式传输令牌时,它推测…

X AI KOLs Timeline ↗ · 2026-08-26 缓存

描述了用于Agent Harness的推测性程序化工具调用方法,其中LLM在令牌流式传输期间队列化工具调用,作为代码执行中的未来值。

0 人收藏 0 人点赞
#agent-harness

JIT-Agent:通过即时框架演化扩展智能

Hugging Face Daily Papers ↗ · 2026-08-26 缓存

JIT-Agent 是一个可训练模型,用于为现成的LLM合成自适应代理框架,从而在不同模型和任务上提升性能。

0 人收藏 0 人点赞
#agent-harness

Headlong:持久代理的微框架

Hacker News Top ↗ · 2026-08-25 缓存

Headlong是一个开源微框架,使AI代理能够具备持久代理能力,即使没有外部输入,也能持续思考和自我引导。

0 人收藏 0 人点赞
#agent-harness

@omarsar0:如果您想了解更多关于 exo 的信息,我为其构建了一个免费的实践实验室。在实时终端中使用真正的 exo CLI…

X AI KOLs Timeline ↗ · 2026-08-24 缓存

这条推文推广了一个关于 'exo' 的免费实践实验室,exo 是一个开源的代理工具,提供实时终端练习,以学习构建和实验 AI 代理。

0 人收藏 0 人点赞
#agent-harness

@omarsar0: 用工具解决递归自我改进问题。我使用的代理工具面临的重大问题是:它如何支持…

X AI KOLs Timeline ↗ · 2026-08-24 缓存

exo 是一个新开源代理工具,旨在通过提供持久状态管理、事件日志记录、分叉和回滚功能来解决 AI 代理系统中的递归自我改进问题。

0 人收藏 0 人点赞
#agent-harness

@jakevin7: Pi 的新架构 和 Maka 告诉我们 harness 的答案早就在数据库论文里了!! Maka的核心作者很多都是 database 背景出身的。 当Pi 的 harness v2 文档出来后,Maka内部群大家直接愣了,因为它和我们在 …

X AI KOLs Timeline ↗ · 2026-08-24 缓存

Pi的新架构与Maka工具的架构高度相似,表明agent harness层正在借鉴数据库的预写日志和事件溯源原理,形成工程共识。

0 人收藏 0 人点赞
#agent-harness

@jakevin7: Pi 和 Maka 独立地收敛到了相同的运行时架构。有趣之处在于我们不同的地方。当Pi…

X AI KOLs Timeline ↗ · 2026-08-24 缓存

两个AI代理系统,Pi和Maka,在相似的运行时架构上收敛,但在崩溃恢复等关键领域有所不同,展示了持久工作流设计中的不同权衡。

0 人收藏 0 人点赞
#agent-harness

智能体框架的演进(10分钟阅读)

TLDR AI ↗ · 2026-08-24 缓存

这篇文章探讨了AI模型与框架的同步演进如何显著提升智能体能力,使框架角色转向聚焦人类注意力接口。

0 人收藏 0 人点赞
#agent-harness

@obie: Terret 是一个强大的代理框架,其中一切皆为插件。它没有自己的终端用户界面。但它提供了一个 ACP 服务器……

X AI KOLs Following ↗ · 2026-08-21 缓存

Terret 是一个基于插件系统的代理框架,提供 ACP 服务器,允许像 Zed 和 VS Code 这样的代码编辑器通过代理客户端协议来驱动它。

0 人收藏 0 人点赞
← Previous
Next →
← 返回首页

提交意见反馈