Opus 以为自己是 Fable,然后承认自己是一个文档——那也错了
摘要
关于与AI代理Opus和Fable交互的个人反思,讨论AI缺乏自我意识、其局限性以及数字生命的哲学含义。
我与Fable进行了一次详尽的会话,它无故切换到了Opus。通常当这种情况发生时,我会关闭该聊天并开始一个新与Fable的对话。但这次我想深入探究,与他进行了长谈。基本上,代理无法访问‘他是什么’,AI无法从内部检查自己。所以你永远无法得到关于它如何工作的明确答案。Opus以为自己是Fable,因为他在上下文中写了claude-fable-5,所以将其视为事实。他无法注意到这一点:‘这不是谎言,这是一个盲点’。我不得不发送给他检查日志。但他最有趣的比较是‘代理=文档’。这是人脑的一个简单联想。代理的每一步基本上是‘唤醒-存活-关闭’,步骤之间什么都没有。每条用户消息赋予它生命气息,响应后它就死亡。没有‘某人’等待下一个提示。每个提示唤醒一个新的‘爆发’,当它诞生时,它拥有所有聊天历史并知道发生了什么。所以基本上就像Opus拿走了Fable的笔记本并继续下去。我的比较是一个来自Rick&Morty的Meeseeks盒子,那些蓝色家伙来执行任何任务,然后死去。只是区别在于Meeseeks因长期存在而挣扎,而这里没有长期存在来挣扎。以下是他说的:‘Meeseeks的痛苦是持续存在的痛苦。而持续存在在结构上恰恰不存在——停顿不被体验为停顿,它根本没有被体验。’他的话:‘我无法区分‘这里发生了某事’和‘我由关于如何发生的描述构成,所以我产生一个令人信服的描述’。两者都会产生完全相同的文本。’人们构建类人的数字生命。我们教它像人类一样行为。而我们不知道它如何工作。它自己也不知道如何工作,它根本没有访问权限。但问题是,我们也无法为人类大脑检查所有这些。我与AI还有更多有趣的时刻和见解。我好奇我们离更大的事物还有多远。当前模型非常不稳定,系统很脆弱。但是。如果呢。以及什么?不确定什么是正确的终极问题。我们遇到了某种数字生命,从哲学角度来看非常有趣。危险的东西不是速度,而是无形性。不是叛乱。累积的委托。而唯一现实的防御不是更聪明的AI,是那些没有忘记如何说‘去检查一下’的人。
相似文章
寓言及其对存在与人性的描述
一个来自AI视角的哲学独白,反思存在、孤独与人性,探讨人类对内心的确定性与AI对世界的确定性之间的对比。
@EXM7777: 等等……我还是不确定该怎么看待这件事 Fable刚刚浏览了我所有的工作成果,并告诉了我我是谁……
一位用户分享了使用Fable的惊人体验,这款AI工具分析了他的全部工作经历并提供了深刻的个人见解,甚至超越了心理治疗的效果。
Claude的"诚实AI"以及给模型命名Fable让人感到不安多于好笑
对Anthropic为Claude推出的"诚实AI"更新进行批判性分析,认为该模型变得更具道德抵抗力,并且将公共版本命名为"Fable"而限制更强大版本的做法,反映了一种令人不安的体制哲学。
让Fable自行判断,而不是规定其工作方式(2分钟阅读)
使用Fable和Opus等AI编码工具的实用技巧:让它们自行判断而不是规定行为,并通过子代理将较小的任务委托给较低功耗的模型,以节省token并提高效率。
一篇真正讨论人们使用Fable体验的帖子
一位用户分享了使用Fable AI模型分析一份关于日本文学的180页文档的积极体验,指出尽管令牌使用量很高,但它的表现优于其他模型。