telemetry-analysis

标签

Cards List
#telemetry-analysis

当智能体执行失败时:从遥测数据检测与定位运行时故障

arXiv cs.AI · 2026-08-18 缓存

本文介绍了AgentChaosBench,这是一个用于检测和定位基于大语言模型的智能体系统中运行时故障的基准,并使用零样本大语言模型基线进行评估,揭示了故障诊断中的重大挑战。

0 人收藏 0 人点赞
← 返回首页

提交意见反馈