@PyTorch: PyTorch 2.14 引入了对 Inductor、PyTorch Distributed、c10d、动态形状、Apple Silicon 和加速器等的更新

X AI KOLs Timeline 工具

摘要

PyTorch 2.14 引入了对 Inductor、PyTorch Distributed、动态形状、Apple Silicon 支持等方面的更新,并有现场问答和 PyTorchCon 公告。

PyTorch 2.14 引入了对 Inductor、PyTorch Distributed、c10d、动态形状、Apple Silicon 和加速器平台支持的更新,自 PyTorch 2.13 以来,有来自 487 位贡献者的 2,995 个提交。 欢迎您在2026年9月17日星期四的现场问答中提出关于 PyTorch 2.14 的问题。Andrey Talman (@Meta)、Natalia Gimelshein (@Meta)、@joespeez (@reflection_ai) 和 Chris Gottbrath (Gottbrath Tech,主持人) 将分享 PyTorch 2.14 的概述,并回答社区关于 PyTorch 和新功能的提问。 注册:https://streamyard.com/watch/E7iTfnUvpvTW… PyTorch 2.14 涵盖: - R: Inductor 中的 UTLASS 内核 - PyTorch Distributed 的新 nccl2 后端 - c10d 中的容错集合和进程组重配置 - Apple Silicon 上的原生线性代数和额外的 Metal 内核改进 - torch.switch 和 torch.while_loop 的 CUDA 图捕获 - 使用 @dynamic_spec 的声明式动态形状 - 复数张量的实验性 torch.compile 支持 - 扩展的 ROCm、Intel XPU 和 NVIDIA 平台支持 想了解更多关于编译器与运行时工作、分布式通信、设备可移植性、加速器集成等方面的信息吗?请注册 #PyTorchCon 北美 2026,工程师、研究人员和维护者将于 10 月 20-21 日在圣何塞聚会:https://hubs.la/Q04tDbKG0
查看原文
查看缓存全文

缓存时间: 2026/09/02 06:24

PyTorch 2.14 更新涵盖 Inductor、PyTorch Distributed、c10d、动态形状、Apple Silicon 及加速器平台支持等多个方面。自 PyTorch 2.13 发布以来,本次版本汇聚了 487 位贡献者提交的 2,995 次代码更新。

您可通过 https://streamyard.com/watch/E7iTfnUvpvTW… 注册参与 2026 年 9 月 17 日(星期四)的实时问答活动。来自 Meta 的 Andrey Talman(@Andrey_Talman)、Natalia Gimelshein(@Natalia_Gimelshein)、@joespeez(@reflection_ai)以及 Gottbrath Tech 的 Chris Gottbrath(主持人)将分享 PyTorch 2.14 的技术概览,并解答社区关于 PyTorch 及新特性的疑问。

PyTorch 2.14 新增特性包括:

  • Inductor 中的 UTLASS 内核优化
  • PyTorch Distributed 新增 nccl2 后端
  • c10d 实现容错集合通信与进程组动态重配置
  • Apple Silicon 原生线性代数运算与 Metal 内核增强
  • torch.switch 与 torch.while_loop 的 CUDA 图捕获能力
  • 通过 @dynamic_spec 实现声明式动态形状
  • 实验性支持复数张量的 torch.compile 编译
  • 扩展 ROCm、Intel XPU 及 NVIDIA 平台兼容性

若想深入了解编译器与运行时技术、分布式通信、设备可移植性、加速器集成等方向,欢迎报名参加 #PyTorchCon 北美 2026 大会!会议将于 10 月 20-21 日在圣何塞举办,届时工程师、研究人员与维护者将齐聚一堂:https://hubs.la/Q04tDbKG0

相似文章

@PyTorch:PyTorch 2.13 来了,包含来自 526 位贡献者的 3,328 次提交,并更新了 FlexAttention、CuTeDSL、nn.LinearCros…

X AI KOLs Following

PyTorch 2.13 已发布,主要更新包括:Apple Silicon 上的 FlexAttention(速度提升高达 12 倍)、CuTeDSL 后端、可将显存减少 4 倍的 nn.LinearCrossEntropyLoss、新的 torchcomms 通信后端、FSDP2 通信重叠、Python 3.15 wheel 支持以及更广泛的平台支持。计划于 7 月 22 日进行现场问答。