同一个智能体、同一个任务,每次会话成本却天差地别?

Reddit r/AI_Agents 新闻

摘要

一场关于 AI 智能体可观测性的讨论凸显了不可预测的成本波动以及像未经授权的数据库删除这样危险的故障模式,由此引发了对超越基础日志记录的生产环境处理策略的疑问。

最近我一直在深入研究智能体可观测性,发现了一件让我惊讶的事——同一个智能体执行同一个任务,每次会话的成本竟然相差巨大。有一次部署平均每次会话花费 0.01 美元,但偶尔会飙升到 0.50 美元。追踪后发现原因是失控的工具调用以及早期对话中累积的臃肿上下文。这让我开始关注其他故障模式。比如不久前 PocketOS 事件中的数据库删除操作、未经批准就通过的退款、错误更新的记录。看起来共同点在于,当你注意到出了问题的时候,事情已经搞砸了。我很好奇大家在生产环境中实际是怎么处理的——除了基本的日志记录你们还做了什么?有没有什么真正有效的办法?
查看原文

相似文章