昨天我让 Reddit 尝试破解我的 AI 小工具,以下是真实情况。
摘要
作者讲述了让 Reddit 尝试破解其 AI 小工具的结果,分享了来自社区压力测试的意外结果和教训。
暂无内容
相似文章
花了一整晚试图攻破自家的AI病毒式传播评分,结果它一动不动——原因在此。
作者讲述了一整晚试图操纵自家AI病毒式传播评分系统的经历,却发现分数拒绝改变,展现了系统的稳健性。
五天前,我从未构建过Reddit应用
一位开发者讲述了如何在五天内利用AI从零构建一个Reddit应用,认为AI的主要价值在于降低从想法到原型的门槛,奖励好奇心而非技术专长。
我让100个AI人格在Reddit上运行了一个月——它们形成了派系,从帖子到帖子都心存积怨,你可以输入任何标题看它们蜂拥而至
这个实验在一个Reddit风格的论坛上运行了100个LLM人格,展示了涌现的社交动态,如派系和持久的积怨,使用Node.js构建,并使用了OpenRouter的deepseek-chat。
当2000人试图破解我的AI助手后发生了什么
一篇博客文章报告称,在超过2000人进行的6000次尝试后,没有人成功通过提示注入从AI助手(由Opus 4.6驱动)中泄露秘密,突显了模型抵抗力的提升,但提醒不要过度自信。
两周前我提问了代理与真实世界之间会出什么问题。你们的两个回复现在已成为任务
作者跟进之前的讨论,从社区报告的事件中创建公共基准任务,以测试AI代理在认证和预订等真实场景中的失败情况,并征求关于不变量检查的意见。