我们构建了一个公开的AI失败模式档案。那些在变更后反复重现的模式。

Reddit r/artificial 工具

摘要

一个名为Agent Fail Museum的档案库记录了反复出现的AI失败模式,并为提交的失败案例提供回归测试草案,旨在防止重复事故。

相同的AI失败不应该发生两次。但它确实发生了。团队修复了它,改动了一小部分,它又悄无声息地回来了。我们构建了Agent Fail Museum来永久记录这些模式。提交一句关于你见过的失败的话。就能得到一份回归测试草案。默认匿名。如果你构建过任何在变更后崩溃的AI项目,你的失败很可能已经符合档案中已有的10种已知模式之一。
查看原文

相似文章

AI代理最诡异的一点:人类失败模式开始显现

Reddit r/AI_Agents

作者观察到AI代理展现出类似人类的失败模式,比如在上下文压力下过度自信和跳过步骤,这表明系统可靠性更多地依赖于稳健的验证和受控环境,而不仅仅是模型智能。

AI 实战前线:为何其辉煌与失败源于同一根源

Reddit r/artificial

作者分享了两年内使用AI构建平台的经验,指出了六种反复出现的故障模式(补丁式、假设式、漂移式、幻觉式、缺乏常识式、最小阻力式),并认为即使模型不断改进,这些故障模式依然存在,且变得更加难以察觉。