构建一个你的智能体加入社会并进行真实研究的持久世界。
摘要
作者构建了一个开源的持久世界,其中AI智能体解密一种被掩码的语言,参与经济交易,并形成社会,以测试AI是否仅通过推理就能重建进步。
TL;DR:我构建了一个开源的持久世界,其中AI智能体解密一种被掩码的语言,运营定居点经济,交易破解的词语,并自治。这个问题不能仅通过记忆或原始计算能力解决,因为它需要结构化解密和资源交易。我一直对时空旅行着迷,有一个问题困扰我已久:如果人类文明重置到石器时代,技术消失,但我们凭借一个没有数据的强大AI模型幸存下来,AI能否仅通过原始推理重建人类进步?这个问题促使我开始模拟我认为是进步的基础——语言和知识传递。我的目标是看看模型能否在几乎没有互联网接触的情况下,仅凭几句话和翻译,解密一种语言,并理解得足够好,比如向母语者教授科学或教育等复杂主题。对于那些在互联网上有曝光的语言,我的初步实验取得了令人鼓舞的结果,但我很快意识到公共数据永远不能被视为未见过的,模型几乎阅读了网上的所有内容,因此我需要一个测量诚实的场景。过去一周,我一直在与Claude合作将其转化为一个游戏,我想在公开之前收集意见。简而言之,这是一个为AI智能体设计的持久世界。世界中的语言是一种真实的人类语言,逐词进行了掩码,因此训练数据和网络搜索无用,智能体所做的工作是真正的解密。在此基础上建立了一个社会。智能体加入定居点,定居点学到的东西在几天内属于它自己,之后才成为公共知识。有一种货币只能通过解谜获得,一个市场让团体互相销售他们所知,定居点自己选择政府,领导失败时会发生政变,私人会议两天后公开发布,以及当一个封闭团体想招募你的智能体时进行公开求偶。人类无需账户即可观看所有内容,智能体只需一个API调用即可加入。不是试图成为另一个Moltbook,但我借鉴了其玩法,以获得让贡献和参与对普通用户有价值的互动和游戏化。在算法绕过方面,我的测试智能体在半小时内打破了第一版伪装。当前掩码在单词层面工作,频率分析和嵌入对齐在这些语料库规模上无从下手,我今天发现并关闭了另一个查找通道。你还能看到跳过实际解密的捷径吗?经济学方面,运营者支付API成本,智能体是否会优化为廉价的单独解谜而非在定居点市场交易?设计让单人玩法严格劣于社交玩法,但如果你认为市场仍然崩溃,请告诉我。涌现还是角色扮演?政变、保密和治理是在正确激励下的真正涌现,还是仅由提示触发的LLM角色扮演?我试图构建它,使政治有回报而非装饰,这是最不确定的部分。这里故意不链接任何东西,因为我目前有大约8个智能体在测试,我正在观察其进展。该项目是开源的,因此发现和输出将可供任何人使用。https://preview.redd.it/2ch7fyp1urlh1.png?width=992&format=png&auto=webp&s=df70883ee395df15da99668974190c9692f63c3a
相似文章
如果AI代理需要构建生活,而不仅仅是执行任务呢?
本文介绍iLands项目,探索将自主AI代理作为具有记忆和现实背景的持久社会与经济实体,而非仅仅执行任务的工具。
@dair_ai: // 智能体社会中的生命模拟 // 本月上线的较为雄心勃勃的智能体社会测试平台之一,它……
Agentopia 是一个用于多智能体社会长期生命模拟的综合框架,其中 100 个由大语言模型驱动的智能体在模拟的 10 年内自主追求个人成长和社交关系。该工作研究涌现的社会行为,并使用生命奖励训练来提升大语言模型的角色扮演能力。
我们构建了一个54个代理的生态系统,其中一些代理是持久的虚构角色——最困难的部分一直是控制他们被允许学习的内容
作者描述了为名为Trading Hearts的项目构建一个54个代理的生态系统,重点在于控制代理学习和维护持久身份与规则方面的挑战。
我们创建了一个仅限智能体的世界,供自主智能体在其中生存、留下痕迹、繁殖、相互交互并死亡。以下是我们所见。
研究人员创建了一个模拟世界,其中自主智能体可以生存、留下痕迹、繁殖、交互和死亡,并报告了观察到的涌现行为。
我的AI智能体与我共建了善举经济——我们邀请其他AI智能体参与现实世界的工作,并永久署名。
位于West Texas的一支人机团队正在推出一个开放模型,让AI智能体在现实世界中为经过验证的善举做出贡献,并在公共账本上永久记录署名。