harness-engineering

标签

Cards List
#harness-engineering

@seekjourney:一个值得密切关注的强劲新RSI信号:Google Research 已开始研究递归自我改进……

X AI KOLs Timeline ↗ · 2天前 缓存

Google Research 已开始为 Agent Harness 研究递归自我改进,重点是无需模型重新训练即可自动迭代提示、工具、内存和控制流。这种 Harness 级别的方法被认为比模型级别的 RSI 更清晰、更实用。

0 人收藏 0 人点赞
#harness-engineering

@mardehaym: 要真正理解AI代理,你必须理解框架。而且这不是模型。我深入探讨了一个运作的…

X AI KOLs Timeline ↗ · 2026-09-09 缓存

这篇文章强调,在AI代理中,框架——包括工具、上下文、控制和工作流——对于实现可靠、安全和可追溯的结果比模型更为关键。

0 人收藏 0 人点赞
#harness-engineering

工具工程

Hacker News Top ↗ · 2026-08-27 缓存

工具工程是一种实践,用于在AI辅助开发中维护代码质量,通过使用确定性工具和基于代理的审查来防止代码库漂移,并确保长期一致性。

0 人收藏 0 人点赞
#harness-engineering

循环是产品,而非模型——本月的两场演讲从相反角度阐述了这一点

Reddit r/AI_Agents ↗ · 2026-08-25

两场演讲和一篇博客文章认为,在生产环境中拥有AI智能时,反馈循环和框架工程比模型权重更重要,并强调了上下文管理和成本考虑。

0 人收藏 0 人点赞
#harness-engineering

@GoogleCloudTech: https://x.com/GoogleCloudTech/status/2091986652595950079

X AI KOLs Timeline ↗ · 2026-08-24 缓存

本文介绍了驾驭工程作为控制AI代理的关键趋势,通过设计确定性环境并使用如Google Antigravity SDK等工具,展示了团队如何通过沙箱化和修复循环来发布使用AI生成代码的软件。

0 人收藏 0 人点赞
#harness-engineering

@GitHub_Daily: 想搞懂 Claude Code 底层怎么设计的,若直接看源码无从入手,而博客又讲得太零散。 最近在 GitHub 上发现 harness-books 用两本书把架构拆解讲清楚了,结构比我预想的清晰。 第一本聚焦运行时结构,权限怎么管、上下…

X AI KOLs Timeline ↗ · 2026-08-21 缓存

本文介绍了在GitHub上发现的两本书,详细解析了Claude Code的底层架构和设计哲学,对比了Claude Code与Codex,帮助开发者理解AI编码代理的设计逻辑。

0 人收藏 0 人点赞
#harness-engineering

RL Environments Are All You Need (6 minute read)

TLDR AI ↗ · 2026-08-06 缓存

The author argues that RL environments serve as the essential data for building AI agents, enabling systematic training, prompt optimization, and evaluation rather than manual iteration.

0 人收藏 0 人点赞
#harness-engineering

@omarsar0:推荐阅读。仅harness engineering的机会就难以衡量。如果你是AI构建者,ha…

X AI KOLs Following ↗ · 2026-08-01 缓存

Omar推荐阅读Chamath Palihapitiya的AI投资指南,强调harness engineering和evals对AI构建者的重要性。

0 人收藏 0 人点赞
#harness-engineering

Agent 运行越久,我就越不在意提示词

Reddit r/AI_Agents ↗ · 2026-07-24

作者反思了长期运行的人工智能代理如何遭遇与初始提示无关的失败,并认为环境设计(工具、文档、验证、架构规则)更为重要。他们讨论了诸如 harness 工程、保持 AGENTS.md 文件精简、使用 linter 和评估器代理等概念,同时指出了成本权衡。

0 人收藏 0 人点赞
#harness-engineering

@addyosmani: https://x.com/addyosmani/status/2079442194449232227

X AI KOLs Following ↗ · 2026-07-21 缓存

Addy Osmani 的这篇文章探讨了将软件工厂视为规模化代理循环的概念,区分了有人类监督的明工厂和没有人类监督的暗工厂,并强调了理解与设计循环、调控机制和工厂结构的重要性。

0 人收藏 0 人点赞
#harness-engineering

在2026年世界博览会上定义AI工程的五大趋势(17分钟阅读)

TLDR AI ↗ · 2026-07-15 缓存

对2026年AI工程师世界博览会五大趋势的分析,重点介绍了AI工程实践的成熟,如编码智能体、约束工程和系统可靠性,以及从以智能体为中心的开发转向围绕模型构建稳健系统的转变。

0 人收藏 0 人点赞
#harness-engineering

@latentspacepod: 5 Trends That Defined AI Engineering at World’s Fair 2026 https://latent.space/p/aiewf26trends @ricmac's big recap of @…

X AI KOLs Timeline ↗ · 2026-07-14 缓存

A recap of five major trends from the 2026 AI Engineer World's Fair, showing how AI engineering has matured from prompt engineering to building reliable systems, with a shift from agents to harnesses, loop engineering, enterprise adoption, coding agents replacing IDEs, and skill-based agent platforms.

0 人收藏 0 人点赞
#harness-engineering

自动化的未来将是:截图->思考->响应->截图

Reddit r/AI_Agents ↗ · 2026-07-11

作者分享了利用 harness engineering 和免费的 NVIDIA NIM 端点构建 AI 代理的个人经验,这些代理能够自动化复杂的多步骤工作流,例如创建 AI 视频系列和酒店预订系统,并建议网络爬虫服务可以被免费的前沿模型取代。

0 人收藏 0 人点赞
#harness-engineering

@PandaTalk8: 不要再去读 X 上又臭又长的 harness 工程的文章了, 跟这篇文章相比, X 上的那些文章垃圾都不如。 Lilian-weng 的这篇新的博客文章, 是我目前读过的最写的清晰、最容易理解的 harness 工程, 也是递归自我改进的…

X AI KOLs Timeline ↗ · 2026-07-10 缓存

推荐并翻译了Lilian Weng关于Harness Engineering for Self-Improvement的博客文章,详细介绍了递归自我改进(RSI)的概念、Harness的模式(工作流自动化、文件系统持久记忆、子Agent)以及编码Agent案例。

0 人收藏 0 人点赞
#harness-engineering

从提示到契约:面向可审计企业级LLM代理的约束工程

arXiv cs.AI ↗ · 2026-07-10 缓存

介绍了一种约束工程方法,用于构建可审计的企业级LLM代理,通过将确定性行为转移到代码、模式和验证工件中,并在韩国企业数据上通过故障注入和模型替换测试进行了演示。

0 人收藏 0 人点赞
#harness-engineering

@MaxForAI: Harness Engineering的提出者,前OpenAI工程师 Ryan Lopopolo @_lopopolo 宣布他加入Google Cloud 担任首席Agent工程师 Ryan Lopopolo 是 OpenAI Agent…

X AI KOLs Timeline ↗ · 2026-07-09 缓存

前OpenAI工程师Ryan Lopopolo加入Google Cloud担任首席Agent工程师,将OpenAI的Agent工程方法论引入云平台。

0 人收藏 0 人点赞
#harness-engineering

Harness Engineering for Self-Improvement(28 分钟阅读)

TLDR AI ↗ · 2026-07-08 缓存

这篇博客文章由 Lilian Weng 撰写,探讨了递归自我改进在 AI 中的概念,重点介绍了 harness engineering——即围绕基础模型的系统——如何通过工作流设计和评估实现 AI 代理的自动化和改进。

0 人收藏 0 人点赞
#harness-engineering

@SakanaAILabs:从“Harness工程”到RSI 递归自我改进(RSI)——即AI自我构建与提升——将如何实现…

X AI KOLs Timeline ↗ · 2026-07-07 缓存

Lilian Weng的博客文章认为,AI中的递归自我改进(RSI)将通过完善“harness”(模型周围系统)的设计与优化来实现,并重点介绍了Sakana AI的研究案例。

0 人收藏 0 人点赞
#harness-engineering

@lilianweng: 关于AI自我改进的 Harness 工程新博文:https://lilianweng.github.io/posts/2026-07-04-harness/… 这是……

X AI KOLs Timeline ↗ · 2026-07-07 缓存

Lilian Weng 的博文探讨了 Harness 工程的概念,将其作为 AI 系统递归自我改进的关键组成部分,讨论了设计模式、工作流自动化以及与操作系统的类比。

0 人收藏 0 人点赞
#harness-engineering

@Yonah_x: https://x.com/Yonah_x/status/2073313721829540171

X AI KOLs Timeline ↗ · 2026-07-04 缓存

本文分享了团队如何借鉴OpenAI的Harness工程理念,让AI Agent自主运行17小时、16轮迭代优化prompt,并成功上线的实践过程,包括防作弊、防止早停等关键机制。

0 人收藏 0 人点赞
Next →
← 返回首页

提交意见反馈