@vintcessun: 一直以为AI agent只能写普通代码,没想到MIT HAN Lab直接用agent流程来设计和优化CUDA kernel。手工调耗时又容易漏方案,他们搞了个“任务合约+agent循环+小步验证”的工作流,让Agent自己研究、实现、验证…
摘要
MIT HAN Lab 提出了一种利用AI agent流程自动设计和优化CUDA kernel的方法,通过任务合约、agent循环和小步验证的工作流,使agent能在专业工具链中自主迭代优化,替代手工调优。
一直以为AI agent只能写普通代码,没想到MIT HAN Lab直接用agent流程来设计和优化CUDA kernel。手工调耗时又容易漏方案,他们搞了个“任务合约+agent循环+小步验证”的工作流,让Agent自己研究、实现、验证、迭代。思路很关键:不是训练一个专用模型,而是定义好约束和验证命令,让Agent在专业工具链里自主试探。这种“把调优变成可复现的Agent流程”的做法,比单次自动生成有意思多了。
相似文章
@AxtonLiu: https://x.com/AxtonLiu/status/2073791557547794579
本文讨论了Agent OS的概念,强调通过分工将任务拆解为多个工位(抓取、提炼、核查、确认),每个工位由独立的Agent负责,以实现可控的自动化。作者通过消化浏览器标签的例子,展示了如何通过分工隔离上下文、责任和风险,确保AI输出的准确性和可靠性。
本文系统梳理了AI Agent架构与工程实践,涵盖控制流、上下文工程、工具设计、记忆、多Agent组织、评测、追踪和安全,基于OpenClaw实现展开,强调Harness(测试验证基础设施)对系统稳定性的关键作用。
本文系统梳理了AI Agent架构与工程实践,涵盖控制流、上下文工程、工具设计、记忆、多Agent组织、评测、追踪和安全,基于OpenClaw实现展开,强调Harness(测试验证基础设施)对系统稳定性的关键作用。
@jakevin7: 分享一下maka 最近在做一件很有意思的事:让 agent 自动优化自己的 system prompt,完全闭环,不需要任何人工介入。Karpathy 的 autoresearch、AEGIS 等都做过类似方向,一个有目标的自我强化学习系…
Maka是一个本地优先的桌面AI工作台,其新功能让agent自动优化自己的system prompt,通过生成变体、容器评测和acceptance policy迭代改进,无需人工介入。
@jinchenma_ai: https://x.com/jinchenma_ai/status/2061835131107860582
文章基于AI Agent(Skill)的工程化方法,提出将确定性的任务固化为脚本,减少大模型运行时的新判断,从而提升稳定性和Token效率。以视频字幕处理为例,展示了四步工程化流程。
@vintcessun: 今晚翻到一个学习路线项目,重新理解了Agent该从哪开始学。以前总觉得Agent就是堆工具和框架,但它的核心是那个“观察-思考-执行”循环,以及harness工程对权限、状态、回溯的组织。它把学习拆成从0构建最小Agent loop到最终…
一个名为Agent-Learning-Hub的开源学习路线项目,将AI Agent学习拆分为8个阶段,从构建最小Agent loop到生产部署,提供可执行的todo list和推荐资源,由Datawhale社区成员维护。