@AYi_AInotes: 两个香港学生,把Karpathy的自动研究框架干到了5倍速。 没换更强的模型,也没加更多算力,甚至代码都没怎么改。 只是在原来的循环上面,又套了一个循环。 这可能是今年对普通Agent开发者最有用的一篇论文,没有之一,具体拆解如下:
摘要
两个香港学生通过在原自动研究框架外再套一层循环,实现了5倍加速,无需更优模型或更多算力,被认为是对普通Agent开发者最有用的论文之一。
两个香港学生,把Karpathy的自动研究框架干到了5倍速。
没换更强的模型,也没加更多算力,甚至代码都没怎么改。
只是在原来的循环上面,又套了一个循环。
这可能是今年对普通Agent开发者最有用的一篇论文,没有之一,具体拆解如下: https://t.co/bIUoEFZI06
查看缓存全文
缓存时间: 2026/07/10 10:09
两个香港学生,把Karpathy的自动研究框架干到了5倍速。
没换更强的模型,也没加更多算力,甚至代码都没怎么改。
只是在原来的循环上面,又套了一个循环。
这可能是今年对普通Agent开发者最有用的一篇论文,没有之一,具体拆解如下: https://t.co/bIUoEFZI06
相似文章
@smallnest: 我把 @karpathy 的autoresearch 移植到自动化的软件开发上,各种优化后,效果吊炸天了
开发者将Karpathy的autoresearch框架移植到自动化软件开发领域,并进行了多项优化,取得显著效果。
@gyro_ai: 复现一篇机器学习论文,最痛苦的是论文写得含糊,关键参数藏在附录里甚至压根没写,你大半时间在当侦探而不是写代码 paper2code 是个 Agent 技能,丢给它一个 arxiv 链接,它生成一份能跑的实现代码,1308 star htt…
Paper2code 是一个 AI Agent 技能,输入 arxiv 论文链接即可生成带有引用锚定的可运行实现代码,自动审计论文中的模糊之处并标记未指定部分,帮助研究者和工程师高效复现机器学习论文。
@vintcessun: 一直以为AI agent只能写普通代码,没想到MIT HAN Lab直接用agent流程来设计和优化CUDA kernel。手工调耗时又容易漏方案,他们搞了个“任务合约+agent循环+小步验证”的工作流,让Agent自己研究、实现、验证…
MIT HAN Lab 提出了一种利用AI agent流程自动设计和优化CUDA kernel的方法,通过任务合约、agent循环和小步验证的工作流,使agent能在专业工具链中自主迭代优化,替代手工调优。
@sitinme: 看到 Karpathy 开源了一个很有意思的项目autoresearch,把一个真实但小型的 LLM 训练任务交给 AI Agent,让它自己做研究、改代码、跑实验、看结果,然后决定保留还是放弃这次改动。 这个项目基于单张 NVIDIA …
Karpathy 开源了一个实验性项目 autoresearch,让 AI Agent 自动完成小规模 LLM 训练的研究循环:修改代码、运行实验、评估结果并迭代优化,人类只需编写研究计划和约束。
@jakevin7: 分享一下maka 最近在做一件很有意思的事:让 agent 自动优化自己的 system prompt,完全闭环,不需要任何人工介入。Karpathy 的 autoresearch、AEGIS 等都做过类似方向,一个有目标的自我强化学习系…
Maka是一个本地优先的桌面AI工作台,其新功能让agent自动优化自己的system prompt,通过生成变体、容器评测和acceptance policy迭代改进,无需人工介入。