self-improving

标签

Cards List
#self-improving

Harness作为语言:一个极简代理框架,具备最大表达能力

arXiv cs.AI ↗ · 2天前 缓存

论文介绍了JAZ,一个极简代理框架,它使用单一的调用原语使LLM代理能够处理长期任务和自我改进,无需外部工具,并在评估中超越了MemGPT和ACE等现有系统。

0 人收藏 0 人点赞
#self-improving

@rohanpaul_ai:哈佛大学、MIT等实验室的新论文展示了自我提升金融AI的更清晰路径:让代理从SEC……学习

X AI KOLs Following ↗ · 4天前 缓存

哈佛大学、MIT等实验室的一篇新论文介绍了FINSKILLOPS,这是一种方法,使金融AI代理能够持续从SEC文件错误中学习,同时使用回归测试来保持正确性并安全更新技能。

0 人收藏 0 人点赞
#self-improving

Show HN: AutoBot – 长时间AI任务的实时语音控制

Hacker News Top ↗ · 2026-09-17 缓存

AutoBot是一个开源智能代理工具,在像OSWorld 2.0和AssistantBench这样的基准测试中,将AI任务完成率比基线提高了18.5%,具有自我改进、层次化记忆和实时语音控制功能,适用于复杂工作流程。

0 人收藏 0 人点赞
#self-improving

AI智能体遭遇了它20分钟前就在自己编写的代码中预测到的bug

Reddit r/AI_Agents ↗ · 2026-09-17

一个自定义的AI智能体自主构建了一个工具,审计了自己的代码,预测到一个bug,之后遇到了它,并通过调整方法恢复了,展示了高级的自我改进能力。

0 人收藏 0 人点赞
#self-improving

@kentcdodds: 我有一个软件包,它能自动处理从使用@kodykoala的用户那里收到的反馈,甚至自动发布修复和改进…

X AI KOLs Following ↗ · 2026-09-15 缓存

Kent C. Dodds分享了一个软件包,该软件包自动化处理反馈和改进,与Kodykoala、Discord、GitHub、CodeRabbit AI和Cursor AI等工具集成,实现软件的自我改进。

0 人收藏 0 人点赞
#self-improving

@MaxBrodeurUrbas:介绍Gumball,模型无关、主动、自我提升。全部在您的公司私有云中

X AI KOLs Following ↗ · 2026-09-10 缓存

Gumball被介绍为一个模型无关、主动且自我优化的系统,适用于私有云。

0 人收藏 0 人点赞
#self-improving

@ycombinator: Harnesses 常被误解为仅仅是框架、仅仅是提示工程,而非真正的研究。但事实远非如此…

X AI KOLs Timeline ↗ · 2026-09-07 缓存

Y Combinator 讨论了框架在 AI 中的重要性,强调了它们在提升模型性能、自我改进代理以及个人 AI 和工作自动化等实际应用中的作用。

0 人收藏 0 人点赞
#self-improving

@tobi: 训练用于特定用例的小型模型效果惊人地好,如果你有一个出色的自我改进递归……

X AI KOLs Timeline ↗ · 2026-09-01 缓存

一条来自@tobi的推文讨论了如何通过自我改进飞轮训练用于专业用例的小型模型非常有效,并指出Shopify ML团队的微调0.8b模型在特定任务上优于GPT 5.6-sol xhigh。

0 人收藏 0 人点赞
#self-improving

Prime Agent: 一个自我改进的RLM框架

Hugging Face Daily Papers ↗ · 2026-08-24 缓存

Prime Agent 是一个开源框架,它使用递归子代理和持久化计算来扩展语言模型在编码和推理任务中的长期能力,显著提高了在ARC-AGI-3等基准测试上的性能。

0 人收藏 0 人点赞
#self-improving

@no_stp_on_snek: 太棒了,最新为机器人提供的Hermes贡献。在开发我的iOS/Android应用以访问我的Hermes会话时发现……

X AI KOLs Timeline ↗ · 2026-08-21 缓存

对Hermes Agent的贡献,这是Nous Research开发的一个自我改进的AI代理,具有记忆、技能创建和面向开发者的多平台支持。

0 人收藏 0 人点赞
#self-improving

@with_gene2626: 什么?397b nvfp4 是一个3或4 Spark配置……显示比所有当前开放权重模型更好的基准测试?有人……

X AI KOLs Following ↗ · 2026-08-19 缓存

Ornith-1.5,一个开源大语言模型家族,推出版本高达397B MoE,在同类模型中达到最先进的性能,并在基准测试中与Claude Opus相媲美。

0 人收藏 0 人点赞
#self-improving

@sunmer575399: 做AI的都该看看hermes-agent。 不是因为204.0k star。 而是它把核心问题解决得很干净 主打"会成长的智能体"——它不固定死一套流程,而是根据你的使用习惯自动调整策略...我跑了两周,感觉它像越用越懂你,比那些死板的自…

X AI KOLs Timeline ↗ · 2026-08-15 缓存

Hermes Agent 是由 Nous Research 开发的自改进 AI 代理框架,支持多环境部署和模型切换,旨在提高开发效率和用户体验。

0 人收藏 0 人点赞
#self-improving

@tom_doerr: Aeon 是一个自主代理框架,可以向你的仓库交付功能、发现真实漏洞,并部署实时…

X AI KOLs Timeline ↗ · 2026-08-07 缓存

Aeon 是一个自主代理框架,可以向仓库交付功能、发现真实漏洞,并部署实时应用,无需审批循环,可在 GitHub Actions 上无人值守运行。它支持跨六种执行环境的 60 多项技能,并且可以为自己编写新技能。

0 人收藏 0 人点赞
#self-improving

@LinusEkenstam:就在睡觉前。让我睡吧。拜托 95.5% 通过 ARC-AGI-3(“如果属实将意义重大”)

X AI KOLs Timeline ↗ · 2026-08-05 缓存

Linus Ekenstam 强调 Prime Intellect 发布了 Prime Agent,这是一个用于编码和长期自主任务的自改进框架,据报道在 ARC-AGI-3 上得分 95.5%,高于人类基线。

0 人收藏 0 人点赞
#self-improving

@latkins: 哟

X AI KOLs Following ↗ · 2026-08-05 缓存

Prime Intellect 推出了 Prime Agent,一个用于编程和长期自主任务的自我改进型 RLM 框架,具备程序化工具调用、将上下文作为变量、多智能体消息传递以及可自我修改的框架状态等特点。

0 人收藏 0 人点赞
#self-improving

@rvaniaaaa:有人构建了一个能自学新技能的AI代理。唯一的人工步骤是最终审批。8个代理。一个循环…

X AI KOLs Timeline ↗ · 2026-08-04 缓存

这个新AI代理系统由八个专门代理组成,能够自主从GitHub发现、验证并整合新技能,仅在合并前需要人类最终审批。

0 人收藏 0 人点赞
#self-improving

@RohOnChain: 别浪费两年时间学习构建自我改进的AI智能体。斯坦福刚推出了一门3小时的课程,教你构建AI智能…

X AI KOLs Timeline ↗ · 2026-08-03 缓存

推文重点介绍斯坦福大学一门3小时的课程,该课程从头开始构建自我改进的AI智能体,涵盖基础知识、多步推理和从反馈中学习,并提到AI工程师的高薪。

0 人收藏 0 人点赞
#self-improving

@0xMovez:别浪费两年时间去搞懂AI代理实际上是如何工作的。例如,Anthropic和Google的工程师在斯坦福刚刚发布了…

X AI KOLs Timeline ↗ · 2026-08-03 缓存

一则推文重点介绍了Anthropic和Google工程师在斯坦福的讲座,内容涵盖自我改进的AI代理、代理循环模式以及生成器-验证器差距。

0 人收藏 0 人点赞
#self-improving

一款自我教学的分类器:用于动态文档分类的自我改进式冻结门训练(SIFT)

arXiv cs.CL ↗ · 2026-07-22 缓存

SIFT引入了一种自我改进的文档分类器,它使用成本低廉的SPLADE-LightGBM管道和LLM评判器持续自我教学,同时通过冻结门安全机制防止无声退化,从而无需人工标注开销即可实现自主再训练。

0 人收藏 0 人点赞
#self-improving

每月110美元的自优化流水线(5分钟阅读)

TLDR AI ↗ · 2026-07-16 缓存

一位开发者分享了他们每月110美元的自动化流水线,该流水线使用Claude AI对GitHub issue进行分类、分解、实现和测试,在两周内完成了27次合并,且故障极少。

0 人收藏 0 人点赞
Next →
← 返回首页

提交意见反馈