agent-reliability

标签

Cards List
#agent-reliability

@ZhihuFrontier: Long-Horizon Agents Need More Than Bigger Context Windows AI Agents are moving from short conversations into software e…

X AI KOLs Timeline · 2026-08-03 缓存

A new survey from Renmin University reviews nearly 1,000 studies on long-horizon AI agents, arguing that reliable long-horizon intelligence depends on the whole model-harness system, not just larger context windows or stronger models.

0 人收藏 0 人点赞
#agent-reliability

AgentAbstain: LLM 智能体知道何时不应行动吗?

arXiv cs.AI · 2026-07-14 缓存

本文介绍了 AgentAbstain,这是首个系统评估 LLM 智能体在适当时刻克制行动能力的框架,包含一个涵盖 8 种不作为场景的 263 个配对任务的基准测试。最佳智能体仅达到 59.5% 的配对准确率,揭示了一个与通用任务解决能力无关的关键差距。

0 人收藏 0 人点赞
#agent-reliability

百万颗人工智能卫星看似不可避免,瓶颈从来都不在算力

Reddit r/singularity · 2026-07-11

文章认为,人工智能真正的瓶颈并非算力,而是多步长任务中的软件可靠性。即使将数据中心部署在轨道上,也无法解决智能体漂移和故障检测等根本性问题。

0 人收藏 0 人点赞
#agent-reliability

开发者实际选择的智能体可靠性工具:LangSmith、Langfuse、Phoenix、Braintrust 和 Galileo 在四个层面的映射。

Reddit r/AI_Agents · 2026-07-10

本文比较了在四个层面上用于智能体可靠性的热门开发者工具:追踪/评估、运行时护栏和网关。结果表明,没有一款开源工具能覆盖所有层面,大多数开发者会组合使用多种工具。

0 人收藏 0 人点赞
#agent-reliability

你的语音助手无法察觉自己的过度承诺。这是结构性问题,不是调优问题。

Reddit r/AI_Agents · 2026-07-10

文章指出了语音助手的一个结构性缺陷:它们无法检测到在多个对话回合中过度承诺的情况,并描述构建了一个确定性检查器,能在不依赖LLM评估的情况下标记矛盾。

0 人收藏 0 人点赞
#agent-reliability

少推理,多验证:确定性门控机制修复工具使用型LLM智能体中的静默策略违规故障模式

arXiv cs.AI · 2026-07-09 缓存

本文识别了工具使用型LLM智能体中的一种静默故障模式,其中策略违规发生时既无工具错误,也无智能体自我报告。作者提出并评估了轻量级确定性预执行门控机制,该机制在τ²-bench航空领域显著减少了此类故障。

0 人收藏 0 人点赞
#agent-reliability

@LiorOnAI: Hy3 花了更少时间去追逐另一个基准点,而是更多时间修复那些让智能体悄然失败的问题。工具…

X AI KOLs Following · 2026-07-06 缓存

腾讯发布了 Hy3,一个 295B 的 MoE 模型,专注于智能体任务的实用可靠性,采用 Apache 2.0 开源许可证,并提供两周的免费 API。

0 人收藏 0 人点赞
#agent-reliability

@WenZikai: 提升智能体可靠性的一个非常有趣的方向。让元智能体监控并在智能体偏离轨道时进行干预…

X AI KOLs Following · 2026-07-04 缓存

一篇新论文提出使用元智能体来监控并在智能体偏离轨道时进行干预,这有可能使自主任务完成率翻倍。

0 人收藏 0 人点赞
#agent-reliability

无评估可捕捉的智能体失败模式:使用缓存的过时事实

Reddit r/AI_Agents · 2026-07-01

讨论AI智能体可靠性中的一个盲点:缓存在获取时是真实的事实,但在使用时已经过时,导致一致但不正确的行为。提出将一致性(与源匹配)与时效性(源目前仍然真实)分开,并询问社区如何处理这个问题。

0 人收藏 0 人点赞
#agent-reliability

@Kimberl9633: LangChain 今天连发两记,直接把 agent reliability 往前推了一步:一套统一评估栈,一个不用完整沙箱的代码执行方案。 先说评估。长运行、有状态的 agent 怎么测?Harbor + LangSmith 的组合给出…

X AI KOLs Timeline · 2026-06-30 缓存

LangChain 发布了统一评估栈(Harbor + LangSmith)和基于 WASM+QuickJS 的进程内代码执行方案,旨在提升 AI agent 的评估可靠性与执行安全性。

0 人收藏 0 人点赞
#agent-reliability

指令泄漏:提示组合型智能体系统中的跨模块干扰

arXiv cs.AI · 2026-06-26 缓存

本文形式化了‘组合行为泄漏’(CBL),这是提示组合型智能体系统中的一种故障模式:由于Transformer自注意力机制缺乏模块级隔离,编辑一个提示模块会静默改变其他模块的行为。本文提出了一个可操作的定义、一个可复用的三通道协议,以及在Claude Sonnet 4.6智能体上进行的144次试验的实证证据,发现了亚阈值干扰,这种干扰可能在数千个决策中累积。

0 人收藏 0 人点赞
#agent-reliability

决策与执行之间的鸿沟

Reddit r/artificial · 2026-06-11

反思基于LLM的自动化支持在出现错误时如何导致信任问题,强调验证和可审计性比单纯提高准确性更重要。

0 人收藏 0 人点赞
#agent-reliability

PACE:自进化代理的任意有效验收测试

arXiv cs.AI · 2026-06-09 缓存

PACE 为自进化代理引入了一种任意有效的提交门,它用序贯假设检验替代贪婪接受,控制错误提交概率,减少震荡,同时保持性能且方差更低。

0 人收藏 0 人点赞
#agent-reliability

当你的智能体批准计划后,它实际遵循计划的频率有多高?

Reddit r/AI_Agents · 2026-05-30

一位开发者讨论了AI智能体在多步骤工作流程中偏离已批准计划的常见问题,寻求缩小计划与执行之间差距的建议。

0 人收藏 0 人点赞
#agent-reliability

Step 3.7 Flash 开放权重今日发布,而智能体可靠性数据确实引人注目

Reddit r/artificial · 2026-05-29

Step 3.7 Flash 是一款开放权重的 198B 稀疏 MoE 模型,声称在 tau2-bench 上所有难度级别均达到 98% 的智能体可靠性,原始能力中等但多步一致性强劲。

0 人收藏 0 人点赞
#agent-reliability

不是能力问题:LLM智能体层级间的控制敏感度是非单调的

arXiv cs.AI · 2026-05-27 缓存

本文通过实证测试了“更结构化的控制(harness)能普遍提高LLM智能体可靠性”这一常见假设,发现不同模型层级间存在非单调关系。它引入了HEAT-24基准,并揭示了严格的控制可能会损害前沿聊天模型,但有利于推理模型。

0 人收藏 0 人点赞
#agent-reliability

你的AI代理实际上并不了解你,它只是记住了关于你的错误信息

Reddit r/AI_Agents · 2026-05-23

文章警告称,AI代理的记忆系统优先考虑回忆而非准确性,导致过时或不正确的假设难以追踪或修复,除非重置一切。

0 人收藏 0 人点赞
#agent-reliability

如何捕捉AI智能体遗漏应执行操作的情况?

Reddit r/AI_Agents · 2026-05-18

一位开发者探讨了检测AI智能体静默跳过操作时的挑战,强调了区分合理遗漏(如策略阻止)与失败之间的困难,并呼吁合作开发智能体可靠性工具。

0 人收藏 0 人点赞
#agent-reliability

我认为人们低估了代理离开演示阶段后“状态”的重要性

Reddit r/AI_Agents · 2026-05-15

关于AI代理从干净的演示环境过渡到混乱的生产环境时,状态管理的挑战被低估的深刻反思,累积的状态混乱常常导致推理失败。

0 人收藏 0 人点赞
#agent-reliability

人类总会打破规则,AI亦然:论“硬性门禁”的必要性

Reddit r/artificial · 2026-05-13

本文分析了 PocketOS 一起由 AI 代理误删生产数据库的事件,主张采用验证器独立性和可逆性检查等“硬性门禁”,而非单纯依赖提示词工程。

0 人收藏 0 人点赞
← 返回首页

提交意见反馈