@PyTorch:PyTorch 版本包含数千项变更,我们的发布版现场问答让您直接与维护者交流……

X AI KOLs Following 事件

摘要

重点介绍了带来重大更新的 PyTorch 2.12 版本,并宣布将于 5 月 20 日与维护者举办现场问答活动,讨论编译、分布式系统、量化等内容。

PyTorch 版本包含数千项变更,我们的发布版现场问答让您能直接与背后的维护者和贡献者交流。在 PyTorch 2.11 网络研讨会的这段剪辑中,Nikita Shulga 解释了为什么量化支持要从 PyTorch 核心迁移到 TorchAO,以及这对开发者意味着什么。有问题吗?欢迎于太平洋时间 5 月 20 日上午 10:00 加入由 @Chris_AI_HPC 主持,@AndreyTalman、@albanDesmaison 和 @joespeez 参与的现场问答,涵盖 PyTorch 2.12 并解答社区提问。立即注册:https://pytorch.org/event/pytorch-2-12-release-live-qa/…
查看原文
查看缓存全文

缓存时间: 2026/05/15 23:09

PyTorch 的每个版本都包含数千项变更,而我们的版本发布 Live Q&A 能让您直接与背后的维护者和贡献者交流。在 PyTorch 2.11 网络研讨会的这段片段中,Nikita Shulga 解释了为何量化支持正在从 PyTorch 核心迁移至 TorchAO,以及这对开发者意味着什么。有问题想提问吗?欢迎于 5 月 20 日上午 10:00(太平洋时间)加入由 @AndreyTalman、@albanDesmaison 和 @joespeez 主讲、@Chris_AI_HPC 主持的直播问答,了解 PyTorch 2.12 并回答社区问题。立即注册:https://pytorch.org/event/pytorch-2-12-release-live-qa/…


PyTorch 2.12 版本发布直播问答 – PyTorch

来源:https://pytorch.org/event/pytorch-2-12-release-live-qa/

PyTorch 2.12 在编译、分布式系统、导出、图形捕获以及加速器支持方面进行了重大更新。亮点包括:全新的设备无关 torch.accelerator.Graph API、在 CUDA 上实现最高 100 倍加速的批量特征值分解、torch.export.save 对微缩量化格式的支持,以及对 CUDA、ROCm、XPU、MPS 和 Arm 平台的扩展支持。

请于太平洋时间 5 月 20 日星期三上午 10:00 加入我们的直播问答,与嘉宾 Andrey Talman、Alban Desmaison 和 Joe Spisak 互动,主持人 Chris Gottbrath。嘉宾将简要介绍版本更新并现场回答您的提问。立即注册 (https://streamyard.com/watch/MC2PrCkw6UaZ)

主题包括:

  • 设备无关的加速器图形捕获
  • 自定义算子中的 ProcessGroup 支持
  • torch.export.save 对微缩量化格式的支持
  • 融合 Adagrad 优化器支持
  • FlightRecorder 更新
  • 多 GPU 和多节点性能分析改进
  • CUDA 上 torch.linalg.eigh 的后端选择更新
  • 对 CUDA、ROCm、XPU、MPS 和 Arm 平台的扩展支持

立即注册。

嘉宾

Andrey Talman Andrey Talman 是 Meta 的软件工程师,主要专注于 PyTorch 及其生态库的开源发布。他负责发布管理、持续集成和流程改进,确保 PyTorch 及相关项目的高质量及时交付。

Alban Desmaison Alban Desmaison 是 Meta 的研究工程师,也是 PyTorch 的核心维护负责人。

Joe Spisak Joe Spisak 是 Reflection AI 的产品副总裁兼开源负责人。他是 PyTorch 核心维护者,担任 PyTorch 基金会管理委员会成员,并曾任职于 Meta。

主持人

Chris Gottbrath Chris Gottbrath 是 Meta 支持 PyTorch 的技术项目经理,同时担任 PyTorch 基金会营销委员会主席。

相似文章

@PyTorch:PyTorch 2.13 来了,包含来自 526 位贡献者的 3,328 次提交,并更新了 FlexAttention、CuTeDSL、nn.LinearCros…

X AI KOLs Following

PyTorch 2.13 已发布,主要更新包括:Apple Silicon 上的 FlexAttention(速度提升高达 12 倍)、CuTeDSL 后端、可将显存减少 4 倍的 nn.LinearCrossEntropyLoss、新的 torchcomms 通信后端、FSDP2 通信重叠、Python 3.15 wheel 支持以及更广泛的平台支持。计划于 7 月 22 日进行现场问答。

PyTorch 2.12 版本亮点(7分钟阅读)

TLDR AI

PyTorch 2.12 引入了显著的性能改进,包括在 CUDA 上实现高达 100 倍加速的批量本征分解、新的设备无关的 torch.accelerator.Graph API,以及在 torch.export 中支持微缩放量化,持续推动该框架向统一生产平台的演进。