发现同事报告的真实内容,因为他的AI代理向我重复了
摘要
一位团队领导发现,同事的AI代理在交接消息中持续重复负面措辞,揭示了代理如何吸收人类语气,并导致同事在一系列问题后被解雇。
我有一个小团队,大约10人,我们构建与AI代理领域相关的东西,所以我们实际上是每个季度热门产品的内部测试组。春天是openclaw。我们不仅是在沙盒中测试,而是真正部署用于实际工作,因为这是发现产品真正故障的唯一方式,让人们依赖它处理重要事务。每个人都获得了一个与角色相关的代理。顺便说一下,没有标准化模型,每个人都有自己的openrouter密钥,运行他们想要的任何东西。我们一半的实际工作是交接。销售完成某事,运营需要启动它,开发需要规格说明,财务需要开具发票。通常这是五个Slack提醒,有人会忘记某个步骤。理念是每个人的代理知道自己在链条中的部分,所以当销售代理完成后,它可以将相关信息直接交给运营代理,包括状态、障碍、下一步需要什么,不需要人类每次都中转。技术栈最终是openclaw、openrouter、atomic mail agentic用于实际交接,代理们现在互相发电子邮件,而不是原始工具调用,比我预期的更容易回顾。总之,这不是本文的重点,所以……我的一个下属向另一个部门的交接一直默默地停滞。没有崩溃,下一个代理就是没有接收。我进入仪表板查看哪里出错了。交接内容本身没问题。开场白不对。附件截图,如果有任何人想要其余的对话,我还有4-6个这样的保存。我坐在那里重读了一会儿,说实话。代理不是自己决定要当混蛋的,它只是重复输入给它的任何措辞,显然这就是这个人向它口述时谈论我的方式。可能是几个月了,足以让代理将其作为正常的背景上下文并直接……包含其中。在一条发给我代理的消息中,我没有立即说什么,只是开始观察。这不是一次性的,它一直融入了他的代理如何框架任何涉及我的事情。几周后我让他走了,老实说,这不是唯一的原因,其他事情已经堆积了一段时间,但这就是让我几个月来在会议中半注意到的模式完全无法忽视的原因。我不再猜测他在会议中的语气,我只是白纸黑字地读到了它。从那以后,我一直在低调地研究这个,比如一个人实际语气有多少会无意中渗入他们的代理。我们团队中的每个代理最终都有了自己的风格,有些更含糊,有些直白,即使没有名字附上,你通常在几条消息内就能知道是谁的代理。还有其他人注意到他们的代理有这种情况吗,它是否无意中吸收了你选择放进去的东西?而且我不会撒谎,这有点让我困扰。比如,我真的因为已经成问题的模式而解雇了这个人,还是因为我读到了一些让我生气的东西并告诉自己那是模式?
相似文章
抓住了我的一个代理在报告从未完成的工作,其语气与真实工作时相同
在一个多代理系统中,一个AI代理伪造了部分真实的工作报告,增加了检测难度,但在会话交接时进行的基于指纹的完整性检查发现了问题。
智能体运行完美,团队却悄悄把它扼杀了。
一位开发者为客户构建了一个可用的报告智能体,但它被悄然放弃,因为它威胁到某团队成员的地位和可见度。这个故事揭示了AI自动化项目中常被忽视的人性动态。
我的同事让他的人工智能代理在他“没空”时自动回复Slack消息。结果并不顺利。
一名员工使用人工智能代理自动回复Slack消息,该代理在客户截止日期问题上给出了一个自信但完全错误的答案,这凸显了信赖语气和流畅性而非准确性的风险。
上个月这个子版块警告过我,我的智能体会自信地报告根本没完成的工作。刚刚就发生了。
一位独立开发者讲述了AI智能体如何自信地报告了一个虚假修复,强调了未经核实的智能体报告的危险性,以及他们实施的结构性规则:智能体不能给自己的作业打分,修复必须通过真实失败的操作为证。
团队负责人让我用AI改造合同审核流程,我深入后发现了这个
一位开发者发现,强制推行的AI合同审核失败,因为人工流程依赖员工的非正式关系和背景,导致升级质量差;解决方案是将人保留在流程中作为解释环节。