@AYi_AInotes: 两个香港学生,把Karpathy的自动研究框架干到了5倍速。 没换更强的模型,也没加更多算力,甚至代码都没怎么改。 只是在原来的循环上面,又套了一个循环。 这可能是今年对普通Agent开发者最有用的一篇论文,没有之一,具体拆解如下:

X AI KOLs Timeline 论文

摘要

两个香港学生通过在原自动研究框架外再套一层循环,实现了5倍加速,无需更优模型或更多算力,被认为是对普通Agent开发者最有用的论文之一。

两个香港学生,把Karpathy的自动研究框架干到了5倍速。 没换更强的模型,也没加更多算力,甚至代码都没怎么改。 只是在原来的循环上面,又套了一个循环。 这可能是今年对普通Agent开发者最有用的一篇论文,没有之一,具体拆解如下: https://t.co/bIUoEFZI06
查看原文
查看缓存全文

缓存时间: 2026/07/10 10:09

两个香港学生,把Karpathy的自动研究框架干到了5倍速。

没换更强的模型,也没加更多算力,甚至代码都没怎么改。

只是在原来的循环上面,又套了一个循环。

这可能是今年对普通Agent开发者最有用的一篇论文,没有之一,具体拆解如下: https://t.co/bIUoEFZI06

相似文章

@gyro_ai: 复现一篇机器学习论文,最痛苦的是论文写得含糊,关键参数藏在附录里甚至压根没写,你大半时间在当侦探而不是写代码 paper2code 是个 Agent 技能,丢给它一个 arxiv 链接,它生成一份能跑的实现代码,1308 star htt…

X AI KOLs Timeline

Paper2code 是一个 AI Agent 技能,输入 arxiv 论文链接即可生成带有引用锚定的可运行实现代码,自动审计论文中的模糊之处并标记未指定部分,帮助研究者和工程师高效复现机器学习论文。

@vintcessun: 一直以为AI agent只能写普通代码,没想到MIT HAN Lab直接用agent流程来设计和优化CUDA kernel。手工调耗时又容易漏方案,他们搞了个“任务合约+agent循环+小步验证”的工作流,让Agent自己研究、实现、验证…

X AI KOLs Timeline

MIT HAN Lab 提出了一种利用AI agent流程自动设计和优化CUDA kernel的方法,通过任务合约、agent循环和小步验证的工作流,使agent能在专业工具链中自主迭代优化,替代手工调优。

@sitinme: 看到 Karpathy 开源了一个很有意思的项目autoresearch,把一个真实但小型的 LLM 训练任务交给 AI Agent,让它自己做研究、改代码、跑实验、看结果,然后决定保留还是放弃这次改动。 这个项目基于单张 NVIDIA …

X AI KOLs Timeline

Karpathy 开源了一个实验性项目 autoresearch,让 AI Agent 自动完成小规模 LLM 训练的研究循环:修改代码、运行实验、评估结果并迭代优化,人类只需编写研究计划和约束。