gpu-kernel-optimization

标签

Cards List
#gpu-kernel-optimization

像人类一样优化CUDA:微剖析工具作为基于LLM的GPU内核优化的专家替代

arXiv cs.LG · 2026-06-26 缓存

KernelPro是一个闭环多智能体系统,利用LLM和微剖析工具自动优化GPU内核代码,在KernelBench上实现了2.42×/4.69×/5.30×的几何平均加速,并在相同速度下实测能耗降低11.6%。

0 人收藏 0 人点赞
#gpu-kernel-optimization

迈向自动化AI研究的第一步 (12分钟阅读)

TLDR AI · 2026-06-12 缓存

Recursive 发布了一个自动化AI研究系统,在三个基准测试中取得了最先进的结果:固定预算语言模型训练、小模型训练速度和GPU内核优化。该系统自动化了研究循环,并开源了其运行中的产物。

0 人收藏 0 人点赞
#gpu-kernel-optimization

@Recursive_SI: https://x.com/Recursive_SI/status/2064980090702962699

X AI KOLs Timeline · 2026-06-11 缓存

Recursive 发布了其自动化 AI 研究系统的早期成果,在固定预算语言模型训练、小模型训练速度以及 GPU 内核优化方面达到了业界领先水平,并开源了相关制品。

0 人收藏 0 人点赞
#gpu-kernel-optimization

AgentKernelArena:兼顾泛化能力的GPU内核优化代理基准测试

Hugging Face Daily Papers · 2026-05-16 缓存

AgentKernelArena是一个开源基准测试,用于评估AI编码代理在GPU内核优化方面的表现,涵盖完整的代理工作流程以及跨196个任务对未见配置的泛化能力。

0 人收藏 0 人点赞
← 返回首页

提交意见反馈