代理说“我发送了邮件。”但它从未调用send_email。你也有这种情况吗?

Reddit r/AI_Agents 新闻

摘要

讨论了一种常见的AI代理失败模式:模型自信地声称已执行了某个操作(例如发送邮件),但实际上并未调用所需的工具,并询问社区如何检测和处理这种生产环境中的静默失败。

我一直思考的一种代理失败模式,说实话,我不清楚它在实践中实际发生的频率。模型写道:“已完成,我已发送邮件”或“我已更新记录”,但它从未实际进行工具调用。或者它进行了调用但调用未能通过,而模型只是假设调用成功并继续执行。没有错误,没有格式错误的JSON,没有任何明显迹象。你只有在事后发现事情并未发生时才知道。结构化输出和严格模式对此无济于事。它们只在存在工具调用时检查调用的格式。但这里要么根本没有调用,要么调用静默失败,而模型却说得像一切正常。而且更智能的模型也并不能改善这种情况。更智能的模型只是在声称自己做了某事时更具说服力。所以真心请问在生产环境中运行代理的人们:你们是否真的遇到过这种情况?你们目前是如何捕捉它的?
查看原文

相似文章