其他人在AI可审计性方面也遇到困难了吗?

Reddit r/AI_Agents 新闻

摘要

作者描述了一个AI可审计性的挑战,其中代理的决策缺乏与活跃策略版本的可追溯性,并就为AI代理决策构建有效决策路径寻求建议。

上个月,一个代理批准了一个折扣覆盖,虽然技术上符合策略,但超出所有人的预期。法律部门的请求很简单:展示决策链,什么规则允许了它,活跃的策略版本是什么,代理在决策时能访问什么。我们有行动本身的日志,但没有任何信息将其与活跃的策略版本或最后修改该规则的人联系起来。我们能证明行动发生了。但无法重构为什么它被允许发生。这与安全事件不同,是可审计性问题,直到有真正权威的人要求书面记录时,问题就出现了。我们正在勾勒一个真正的决策链应该是什么样子,将行动与授权它们的策略联系起来。对于那些为代理决策构建过此功能的人,这个决策路径实际上存储在哪里,以及你们保留多长时间?
查看原文

相似文章