production-agents

标签

Cards List
#production-agents

仅凭代理清单无法告诉你这些代理拥有哪些权限

Reddit r/AI_Agents · 5天前

对生产环境中AI代理权限管理挑战的反思,认为仅靠清单是不够的,团队需要对代理行为进行统一控制,并计划进行后续访谈。

0 人收藏 0 人点赞
#production-agents

生产型AI代理是否需要自己的一类PaaS?

Reddit r/AI_Agents · 2026-07-21

本文认为,生产型AI代理需要超越传统PaaS的新平台抽象,重点在于非确定性规划、持久化执行、授权和可审计性。

0 人收藏 0 人点赞
#production-agents

我构建了一个代理,用于记录你的智能体实际执行的所有操作

Reddit r/AI_Agents · 2026-07-16

我构建了Trovis,一个能够记录并解释生产环境中智能体操作的工具,展示与预期行为的偏差。

0 人收藏 0 人点赞
#production-agents

循环工程是生产代理所缺失的学科吗?

Reddit r/AI_Agents · 2026-07-13

文章探讨了循环工程作为开发稳健的生产代理AI系统时可能缺失的学科。

0 人收藏 0 人点赞
#production-agents

人工审批对于生产级智能体来说过于模糊

Reddit r/AI_Agents · 2026-07-07

文章认为,智能体系统中的人机协同应从模糊的审批转向明确的、可审计的、每步签署的决策记录,包含详细证据、数据载荷、幂等键、回滚路径和职责归属。文章强调了批准黑箱故事而非具体操作的危险性。

0 人收藏 0 人点赞
#production-agents

@rauchg: 自主智能体自我改进。让你的智能体能够检视其过去的运行,发现效率低下、错误、冗余……

X AI KOLs Following · 2026-07-03 缓存

Eve 是一个用于构建持久、生产就绪的 AI 智能体的框架,具有内置的可观测性、内省和自我改进能力,旨在与 Next.js 和 Vercel 部署无缝协作。

0 人收藏 0 人点赞
#production-agents

诊断是生产代理中缺失的技能

Reddit r/AI_Agents · 2026-07-03

文章认为,诊断——用操作术语解释代理为何失败以及接下来安全做什么——是生产代理栈中缺失的一等技能,比让代理听起来聪明更重要。

0 人收藏 0 人点赞
#production-agents

Show HN:Morph Reflexes – 用于智能体轨迹的多头分类器

Hacker News Top · 2026-06-30 缓存

Morph Reflexes 利用共享主干上的多头分类器,从智能体轨迹中提供快速、廉价的语义信号,实现对生产智能体的可扩展监控。

0 人收藏 0 人点赞
#production-agents

@_avichawla: https://x.com/_avichawla/status/2071897559287955680

X AI KOLs Timeline · 2026-06-30 缓存

文章讨论了AI代理的真正挑战不在于构建它们,而在于在生产环境中运行它们,并提出了需要一个操作系统层来管理代理集群,类似于操作系统管理软件进程的方式。

0 人收藏 0 人点赞
#production-agents

@XAMTO_AI: 想自己从零搭一个生产级 Agent Harness?别做梦了,以为随便挑个框架就能收工的,基本全翻车了。 真相是这玩意儿压根不是"选框架"能摆平的事,它背后藏着15项你绕不开的硬核职责: 每一项都得做成能安装、能版本化、还能换语言跑的 w…

X AI KOLs Timeline · 2026-06-18 缓存

The article argues that production agent harnesses should not be monolithic frameworks but rather a stack of independent, replaceable workers connected by a shared trigger primitive, outlining 15 core responsibilities and how the iii engine implements this approach.

0 人收藏 0 人点赞
#production-agents

@googledevs: Most agent demos are stateless. Ask → answer → context gone. Production agents need to run for days — pausing, resuming…

X AI KOLs Following · 2026-06-11 缓存

Google Devs introduces Agent Factory series with ADK 2.0 and Gemini 3.5 Flash, demonstrating how to build production-grade stateful agents that can run for days, featuring insights on skills, MCP, and code review strategies from engineers like Rohde Davis.

0 人收藏 0 人点赞
#production-agents

智能代理界面的演变:使用Claude Managed Agents进行构建(13分钟阅读)

TLDR AI · 2026-06-11 缓存

Anthropic推出了Claude Managed Agents,这是一组可组合的API,用于构建和部署生产级代理,解决了将原型与生产分离的基础设施挑战。

0 人收藏 0 人点赞
#production-agents

我问大家如何处理智能体记忆。以下是回复中的模式,以及无人真正解决的一个问题。

Reddit r/AI_Agents · 2026-06-09

关于智能体记忆的社区讨论显示,尽管在记录什么(如纯文本文件、分层记忆、事后总结)方面存在各种补丁方案,但未解决的问题是保留什么——检测失败是可处理的,但决定哪些教训应持续保留仍需要人类判断。

0 人收藏 0 人点赞
#production-agents

通过受治理运行时运行实时代理时,有三件事让我们感到意外

Reddit r/AI_Agents · 2026-06-09

通过受治理运行时处理市场数据的实时代理实验揭示了三个意外发现:提示结构比推理质量更能决定执行可靠性;结构化输出能够影响代理的决策;将推理和提取分离为两个调用可以维持高解析成功率。这些发现表明,治理应位于执行边界,而非自由形式的推理层。

0 人收藏 0 人点赞
#production-agents

智能体应该是代码还是带有独立运行时的声明式实体?

Reddit r/AI_Agents · 2026-06-08

作者认为,生产环境中的AI智能体应定义为具有独立运行时的声明式清单,而不是分散在应用代码中,以便实现适当的版本控制、可观测性和回滚。他们将自己的解决方案作为开源工具提供。

0 人收藏 0 人点赞
#production-agents

团队如何处理生产环境中代理的身份认证与访问管理?

Reddit r/AI_Agents · 2026-06-08

关于团队如何处理生产环境中AI代理的身份认证与身份管理的讨论,涵盖服务账户、凭证存储、审批工作流和审计。

0 人收藏 0 人点赞
#production-agents

为你的AI代理配备专属计算机(7分钟阅读)

TLDR AI · 2026-06-08 缓存

LangChain推出LangSmith Sandboxes,为每个AI代理提供独立的隔离计算环境以安全执行代码,解决了在容器或本地运行不可信代码的安全风险。

0 人收藏 0 人点赞
#production-agents

你的智能体能力取决于其框架。我开源了一个框架,单个函数调用背后集成了40项能力

Reddit r/AI_Agents · 2026-06-04

一个开源智能体框架,单个函数调用背后集成了40项能力,包括持久内存、Docker沙箱、自动摘要、死循环检测、预算上限和实时运行分支(用于分支智能体执行)。基于Pydantic AI构建,旨在替换每个生产级智能体所需的2000行胶水代码。

0 人收藏 0 人点赞
#production-agents

@ba_niu80557: https://x.com/ba_niu80557/status/2062103965517721821

X AI KOLs Timeline · 2026-06-03 缓存

文章拆解了2026年Agent框架的六条设计路线(LangGraph、OpenAI Agents SDK、CrewAI、Dify、厂商原生SDK、Pi),并提供了基于状态管理、流程复杂度、人机交互、模型灵活性等维度的选型建议,适合需要在生产环境中选择Agent框架的团队参考。

0 人收藏 0 人点赞
#production-agents

Agent Judge:解决生产环境智能体的长上下文评估(10分钟阅读)

TLDR AI · 2026-05-29 缓存

Agent Judge 是一种智能体评估工具,通过处理长轨迹、对照事实源系统验证状态化动作以及适应行为变化,克服了简单 LLM 评判器在长周期智能体评估中的局限性。

0 人收藏 0 人点赞
Next →
← 返回首页

提交意见反馈