@omarsar0: 自我改进的AI是件大事!作为第一步,我一直在探索后训练过程有多少可以自动化。H…
摘要
Marco Oram分享了他使用Fireworks AI Agent自动化LLM微调的探索,微调了一个小型的Qwen模型,以集成到他的PaperWiki项目中,展示了迈向自我改进AI的一步。
查看缓存全文
缓存时间: 2026/05/21 10:15
自我改进的人工智能是一件大事!
作为第一步,我一直在探索后训练中有多少可以自动化。
这里是一篇关于我如何使用 @FireworksAI_HQ Agent 来自动化 LLM 微调本身的帖子。包含数据集 + 技能文件。
对于这个用例,我从 @karpathy 关于 LLM 知识库的推文中获得了灵感。
我让 Claude Code 与 Fireworks Agent 交互,对一个小型 Qwen 模型进行微调,以获得正确的输出风格,从而高效地持续扩展我的 PaperWiki(https://x.com/omarsar0/status/2042286186920550498?s=20…)。
全部通过自然语言完成。这显然是改进 AI 系统的未来。
PaperWiki 项目的下一步是如何调整模型以更好地“理解”数据。这更难做到,但如果可能,我们就拥有一个极其强大的系统,可以递归地自我改进,并且在知识发现和自动化各种端到端研究等方面极为有用。
更多内容即将推出。感谢 Fireworks 团队让我提前测试。对此超级兴奋。
@omarsar0 我最近做到了,哈哈
帖子附带文档链接。
相似文章
@omarsar0: https://x.com/omarsar0/status/2057114824467792189
本文介绍了使用 Fireworks Agent 自动化微调一个小型开放权重模型,以生成维基百科风格的摘要,从而形成一个自我改进的智能体循环,使得模型训练成为一个可调用的步骤。
@omarsar0:关于自我改进智能体的优秀论文。为什么?我们需要更深入地思考 AI 智能体系统设计。该协议规范……
一篇论文提出了一种自我改进 AI 智能体的协议框架,支持可审计的改进提案、评估与回滚。
我构建了一个自我改进的AI,你也能做到
作者使用Claude和AutoResearch等工具实验自我改进AI循环,表明递归自我改进不仅限于前沿实验室,还可以自动化新闻通讯的杂务。
@HuggingPapers: 现代智能体系统中的自我改进——一项涵盖239篇论文的调研,关于AI智能体如何通过更新模型…
一项涵盖239篇论文的调研,分析AI智能体如何通过更新模型本身或框架(提示、记忆、工具)来自我提升。
@qinzytech: https://x.com/qinzytech/status/2066585405479371092
对构建自我进化AI代理的两种方法的技术分析:基于模型的方法(通过像SSMs或具有快速权重更新的transformer等架构,以及训练方法)和基于工具的方法(通过内存或能够自我重写的元工具)。作者为不同受众提供了实用建议。