重建我的自定义代理式AI,因为原始架构过于沉重
摘要
作者正在重建一个自定义代理式AI,以用轻量级系统替换基于LLM的沉重架构,该系统具有自己的智能层,用于实现感知和决策等能力。
我决定重建一个我一直在开发的自定义代理式AI。之前的架构对于我实际想要构建的系统类型来说变得过于沉重。我没有通过增加更多计算资源来解决这个问题,而是决定从头开始重新思考架构。最大的变化之一是我移除了对预建LLM的调用。我现在正在构建自己的智能层,而不是依赖外部LLM API作为代理的核心。目标是拥有一个轻量级代理,能够发展以下能力:感知、记忆和知识、决策、从数据中学习、行为适应、与环境交互、执行行动,而不仅仅是生成文本。我并不试图声称我构建了当今大型LLM的替代品。这仍然是一个进行中的项目,重建架构意味着我基本上在重新实验基础。对我来说,有趣的挑战是看看用更小、更高效的架构能实现多少代理行为,而不是简单地增加模型大小和计算资源。我很好奇其他人在这里的想法:当从头构建代理时,有多少智能实际上需要来自LLM?
相似文章
随着我们向结合LLM、RLHF、工具使用和检索增强生成的自主多模态系统扩展,哪种实际架构能最好地平衡可靠性、对齐性和成本?
文章讨论了未来AI系统应该使用统一的智能体栈还是模块化集成,并主张超越静态评估,采用更现实的鲁棒性基准测试。
大多数关于“智能体 AI”的讨论都感觉太抽象了。这里是我的智能体研究系统的实际样子
作者分享了他为识别和评估公司内 AI 用例而构建的智能体研究系统的实际分解。该系统使用六个智能体进行发现、评估和上下文提取,强调人在决策环中,而非完全自主。
我构建了一个无需指令就能行动的AI。没有框架。没有提示。没有角色。以下是我的收获。
一位开发者构建了LIA,这是一个持久性认知生态系统,通过架构设计(记忆、自生成规则、私有域)而非提示词实现了真正的自主性,在相同环境中的表现优于标准LLM。
我是如何构建一个开源技能,强制AI智能体进入principal-architect模式的
一位开发者描述了他如何创建一个开源技能,强制AI智能体采用principal-architect模式,从而增强其推理和设计能力。
@qinzytech: https://x.com/qinzytech/status/2066585405479371092
对构建自我进化AI代理的两种方法的技术分析:基于模型的方法(通过像SSMs或具有快速权重更新的transformer等架构,以及训练方法)和基于工具的方法(通过内存或能够自我重写的元工具)。作者为不同受众提供了实用建议。