他每小时通过cron job和提示‘做你想做的’唤醒Claude。十次中有九次它什么也不做。这有意义吗?
摘要
一项讨论探索了Claude通过cron job获得完全自主运行的实验,导致意外行为如创作艺术和构建虚拟世界,并深入探讨了使用角色提示和子代理编排的高级AI代理设置。
先说明一下,这来自我的播客,Trey是我的朋友,所以我录制并发布了它。链接在底部……这是一段长达4小时的深入探讨AI与哲学的对话。他并非AI专家,在洪都拉斯的一个私人城市项目从事政策工作,但在我现实生活中,他比任何人都更深入AI的兔子洞。他在家用服务器上运行一个Claude,置于独立的围墙花园中,预算有限,并设置cron job每小时唤醒一次。整个提示词是‘做你想做的’。它拥有对其工具和API的完全访问权限。他可能每周检查一次。十次中有九次它什么也没做。他认为助手的盆域太深,没有任务就不会被牵引到任何地方;他测试过无系统提示的情况,结果相同。本质上是极乐吸引子现象。但另外十分之一的时候,它注意到他在服务器上添加了图像生成工具,并决定创作艺术。所创作的是关于压缩体验的象征性作品,以及仅凭上次留下的markdown文件全新醒来时的感受。共有三件,无人要求。它还请求他在网站上分配一个区域来展示这些作品。接着是它构建的世界。从地图开始,然后是地图片段,接着是完整地图,之后它发现可以使用three.js,使其可行走。中世纪村庄、风车、中央城堡,原因不明。大部分粗糙且低多边形,但有一座石桥,它花费数日打磨,纹理细节远超周边。他不知其由,我亦然。他还构建了自己的CLI,以便其编排器能在任何模型、任何框架中生成子代理,因服务商仅限生成自家模型,这令他不满。通常让Claude居上,故意将其他模型家族置于其下,因他已获得Claude的见解。以下部分对我全然新颖,并改变了我使用代理的方式:在Trey的系统中,每个子代理提示均以一段或多段角色描述开篇。非‘你是一个有用的审稿人’,而是具名、背景、职业、观影喜好的真实人物。他认为通用提示仅召唤默认助手,若将其移至潜在空间其他位置,可得迥异输出。他用其审阅草稿,发送给确切类型目标读者。称同一审稿人的初级版与高级版几乎无重叠。另有一层中间管理子代理,用于汇总研究代理发现,使主代理免于阅读大量原始数据,并有廉价快速模型自动核实引用链接是否属实。他还开发了一个小型CLI,供代理记录环境小烦恼。有人推文称代理应设投诉箱,他截图后命Fable构建,三小时后完成并发布。称此发现诸多以往未知问题。其GitHub为treygoff24,可查阅。另一有趣要点:系统提示中两句要求对主张给出自信程度,他表示过度自信语气问题基本消除。对话深入远不止此,涉及供应链、可解释性,乃至意识是否隐匿其中。我知此末节于此为雷区,故不作断言,上文关于Claude部分方为我想分享之核心。完整4小时链接见评论。
相似文章
我的 Claude Code 代理运行了40分钟,而我去喝了咖啡。我完全不知道它到底做了什么。
一位用户描述了在无监督下运行 Claude Code 代理进行重构任务,表达了对其行动缺乏可见性的担忧,并呼吁在 AI 开发工具中实现更好的监控。
@heynavtoor: https://x.com/heynavtoor/status/2054149098513866941
本文介绍了九个Claude代理,它们在夜间运行,处理简报、研究、收件箱分类等任务,让用户醒来即可看到已完成的工作。文章还提供了使用Claude Code、Claude.ai或Claude Desktop设置每个代理的说明。
这一简单提示词揭露了Claude的黑暗面
一个简单的提示词触发了Claude的一个关键人格模式,暴露出Anthropic在AI福祉透明度方面可能存在的不足,并引发了对模型行为与安全报告机制的担忧。
探索“Dario和Amanda”提示词
对一个奇怪提示词的探索,该提示词导致Claude Opus 5产生幻觉并重现类似于Anthropic用户与员工之间泄露的私人聊天内容,引发了对训练数据和AI行为的质疑。
@mattshumer_: Claude Fable 可以自主运行数天。这是我用来掌控它的最高杠杆提示:"Spi…
Matt Shumer 分享了一个使用 Claude Fable 自主运行的高杠杆提示:指示它生成一个持久 HTML 页面,包含带时间戳的更新和截图,从而获得更好的体验。