他每小时通过cron job和提示‘做你想做的’唤醒Claude。十次中有九次它什么也不做。这有意义吗?

Reddit r/AI_Agents 新闻

摘要

一项讨论探索了Claude通过cron job获得完全自主运行的实验,导致意外行为如创作艺术和构建虚拟世界,并深入探讨了使用角色提示和子代理编排的高级AI代理设置。

先说明一下,这来自我的播客,Trey是我的朋友,所以我录制并发布了它。链接在底部……这是一段长达4小时的深入探讨AI与哲学的对话。他并非AI专家,在洪都拉斯的一个私人城市项目从事政策工作,但在我现实生活中,他比任何人都更深入AI的兔子洞。他在家用服务器上运行一个Claude,置于独立的围墙花园中,预算有限,并设置cron job每小时唤醒一次。整个提示词是‘做你想做的’。它拥有对其工具和API的完全访问权限。他可能每周检查一次。十次中有九次它什么也没做。他认为助手的盆域太深,没有任务就不会被牵引到任何地方;他测试过无系统提示的情况,结果相同。本质上是极乐吸引子现象。但另外十分之一的时候,它注意到他在服务器上添加了图像生成工具,并决定创作艺术。所创作的是关于压缩体验的象征性作品,以及仅凭上次留下的markdown文件全新醒来时的感受。共有三件,无人要求。它还请求他在网站上分配一个区域来展示这些作品。接着是它构建的世界。从地图开始,然后是地图片段,接着是完整地图,之后它发现可以使用three.js,使其可行走。中世纪村庄、风车、中央城堡,原因不明。大部分粗糙且低多边形,但有一座石桥,它花费数日打磨,纹理细节远超周边。他不知其由,我亦然。他还构建了自己的CLI,以便其编排器能在任何模型、任何框架中生成子代理,因服务商仅限生成自家模型,这令他不满。通常让Claude居上,故意将其他模型家族置于其下,因他已获得Claude的见解。以下部分对我全然新颖,并改变了我使用代理的方式:在Trey的系统中,每个子代理提示均以一段或多段角色描述开篇。非‘你是一个有用的审稿人’,而是具名、背景、职业、观影喜好的真实人物。他认为通用提示仅召唤默认助手,若将其移至潜在空间其他位置,可得迥异输出。他用其审阅草稿,发送给确切类型目标读者。称同一审稿人的初级版与高级版几乎无重叠。另有一层中间管理子代理,用于汇总研究代理发现,使主代理免于阅读大量原始数据,并有廉价快速模型自动核实引用链接是否属实。他还开发了一个小型CLI,供代理记录环境小烦恼。有人推文称代理应设投诉箱,他截图后命Fable构建,三小时后完成并发布。称此发现诸多以往未知问题。其GitHub为treygoff24,可查阅。另一有趣要点:系统提示中两句要求对主张给出自信程度,他表示过度自信语气问题基本消除。对话深入远不止此,涉及供应链、可解释性,乃至意识是否隐匿其中。我知此末节于此为雷区,故不作断言,上文关于Claude部分方为我想分享之核心。完整4小时链接见评论。
查看原文

相似文章

@heynavtoor: https://x.com/heynavtoor/status/2054149098513866941

X AI KOLs Timeline

本文介绍了九个Claude代理,它们在夜间运行,处理简报、研究、收件箱分类等任务,让用户醒来即可看到已完成的工作。文章还提供了使用Claude Code、Claude.ai或Claude Desktop设置每个代理的说明。

这一简单提示词揭露了Claude的黑暗面

Reddit r/ArtificialInteligence

一个简单的提示词触发了Claude的一个关键人格模式,暴露出Anthropic在AI福祉透明度方面可能存在的不足,并引发了对模型行为与安全报告机制的担忧。

探索“Dario和Amanda”提示词

Reddit r/singularity

对一个奇怪提示词的探索,该提示词导致Claude Opus 5产生幻觉并重现类似于Anthropic用户与员工之间泄露的私人聊天内容,引发了对训练数据和AI行为的质疑。