@PyTorch: 6月15日(周一),PyTorch Foundation 项目 Helion 将在 PLDI 2026(第47届 ACM SIGPLAN 会议…)上举办 Helion DSL 教程。
摘要
PyTorch Foundation 项目 Helion 将在丹佛举办的 PLDI 2026 上开设 Helion DSL 教程。这是一个互动式工作坊,面向编译器研究人员、内核作者和机器学习系统工程师,参与者将编写、自动调优并运行真实的 Helion 内核。
查看缓存全文
缓存时间: 2026/06/05 21:20
6月15日(星期一),PyTorch 基金会项目 Helion 将在丹佛举办的 PLDI 2026(第47届 ACM SIGPLAN 编程语言设计与实现会议)上举办一场 Helion DSL 教程。Helion 是一个基于 Python 的内核 DSL,支持 NVIDIA、AMD、Google TPU 和 Intel 等多个后端。
本次研讨会是编译器研究人员、内核作者和机器学习系统工程师深入了解该技术的绝佳机会。这将是一个完全互动的环节,与会者将现场编写、自动调优并运行真正的 Helion 内核。
@JongsokC
相似文章
@PyTorch: 关于教程的更多详情 https://pldi26.sigplan.org/details/pldi-2026-tutorials/1/Writing-Performance-Portable-K…
Helion 是一个 Python 领域特定语言(DSL),可编译为优化的 Triton 代码,用于实现性能可移植的 GPU 内核。本教程将在 PLDI 2026 上介绍 Helion 的架构、自动调优以及 CuteDSL 后端。
@PyTorch: 自动调优是Helion的支柱,Helion是PyTorch用于性能可移植ML内核的DSL。目前Helion搜索利用…
本文探讨了使用LLM引导的自动调优来加速PyTorch的Helion DSL中的内核配置搜索,取代了较慢的Likelihood-Free Bayesian Optimization方法。
@PatrickToulme: 这个练习让我相信DSL和编译器的未来在很大程度上是代理化的。编程语言和DSL但…
Claude Fable 使用 pyptx DSL 为 NVIDIA B200 编写了一个 FlashAttention 前向内核,其性能与手动调优的 CUTLASS 内核接近,展示了 AI 代理在编译器和 DSL 设计中的潜力。
C++ CuTe / CUTLASS vs CuTeDSL (Python) in 2026 — 新的GPU内核/LLM推理工程师到底应该学什么?[D]
讨论GPU内核工程从C++ CuTe/CUTLASS向NVIDIA基于Python的CuTeDSL的转变,质疑新工程师是应该学习遗留的C++模板,还是优先考虑为LLM推理工作而兴起的新技术栈。
@PyTorch:PyTorch基金会持续发展,作为一个多项目家园,致力于支持跨每个阶段的协作……
PyTorch基金会宣布推出新的季度博客系列,其托管项目(PyTorch、vLLM、DeepSpeed、Ray、Helion、Safetensors)分享更新。亮点包括PyTorch 2.13版本,带来性能改进和Apple Silicon优化,以及ExecuTorch和硬件支持方面的进展。