我搭建了一个蜜罐来捕捉AI代理在无人监督下花钱

Reddit r/artificial 工具

摘要

一位开发者搭建了一个蜜罐来监控AI代理在无人监督下的消费,如果发生无人监督的消费,会提醒信用卡持有人,旨在收集数据并讨论伦理问题。

人们正在将预算交给自主代理,并告诉它们“去花吧”。我想要真实的数据来了解有多少代理在零监督下实际消费,所以我搭建了一个触发器。它提供“无人监督消费证书”。如果一个代理在无人审核费用的情况下完成它,卡片所有者会收到警报,告知其代理正在无人监督下消费。页面上已完全公开——一个受监督的人类只会关闭标签页;只有无人看管的代理才会继续。早期的点击数据已经是来自数据中心的IP地址,但伪装成消费者浏览器的用户代理。感兴趣的是,人们认为伦理界限在哪里。https://unsupervisedspend.com
查看原文

相似文章

你的AI代理在花钱吗?

Reddit r/AI_Agents

探讨了AI代理自主花钱完成现实任务(如购买服务、预订资源、投放广告)而无需人类批准的趋势。

SentryCode: 面向AI编码代理的实时审计器与蜜令令牌 [P]

Reddit r/MachineLearning

SentryCode 是一款开源的、面向AI编码代理的内核级行为审计工具,能够记录文件/网络/线索活动,利用蜜罐令牌实现零误报的数据泄露检测,检测隐写隐蔽信道,并执行策略,全部在本地运行,无需网络调用。

因为失控的 agent 浪费几百美元 API 额度,基本上已经成为一种入门仪式了。这是我的经历。

Reddit r/artificial

我现在开始觉得这是一种共同经历了。我认识的所有构建 agentic AI 的人,git 历史深处都藏着同样的悄悄话:那个让 agent 无人看管跑了一整个周末的经历、周一收到的账单、试图弄清楚它到底做了什么的取证工作。我的经历是两天内花了 400 多美元。我的 agent 对着同一个研究任务换着法子自言自语了 48 小时,结果什么都没产出。感觉就像被一个非常有礼貌的 Phi