@PyTorch:PyTorch 版本包含数千项变更,我们的发布版现场问答让您直接与维护者交流……
摘要
重点介绍了带来重大更新的 PyTorch 2.12 版本,并宣布将于 5 月 20 日与维护者举办现场问答活动,讨论编译、分布式系统、量化等内容。
查看缓存全文
缓存时间: 2026/05/15 23:09
PyTorch 的每个版本都包含数千项变更,而我们的版本发布 Live Q&A 能让您直接与背后的维护者和贡献者交流。在 PyTorch 2.11 网络研讨会的这段片段中,Nikita Shulga 解释了为何量化支持正在从 PyTorch 核心迁移至 TorchAO,以及这对开发者意味着什么。有问题想提问吗?欢迎于 5 月 20 日上午 10:00(太平洋时间)加入由 @AndreyTalman、@albanDesmaison 和 @joespeez 主讲、@Chris_AI_HPC 主持的直播问答,了解 PyTorch 2.12 并回答社区问题。立即注册:https://pytorch.org/event/pytorch-2-12-release-live-qa/…
PyTorch 2.12 版本发布直播问答 – PyTorch
来源:https://pytorch.org/event/pytorch-2-12-release-live-qa/
PyTorch 2.12 在编译、分布式系统、导出、图形捕获以及加速器支持方面进行了重大更新。亮点包括:全新的设备无关 torch.accelerator.Graph API、在 CUDA 上实现最高 100 倍加速的批量特征值分解、torch.export.save 对微缩量化格式的支持,以及对 CUDA、ROCm、XPU、MPS 和 Arm 平台的扩展支持。
请于太平洋时间 5 月 20 日星期三上午 10:00 加入我们的直播问答,与嘉宾 Andrey Talman、Alban Desmaison 和 Joe Spisak 互动,主持人 Chris Gottbrath。嘉宾将简要介绍版本更新并现场回答您的提问。立即注册 (https://streamyard.com/watch/MC2PrCkw6UaZ)
主题包括:
- 设备无关的加速器图形捕获
- 自定义算子中的 ProcessGroup 支持
torch.export.save对微缩量化格式的支持- 融合 Adagrad 优化器支持
- FlightRecorder 更新
- 多 GPU 和多节点性能分析改进
- CUDA 上
torch.linalg.eigh的后端选择更新 - 对 CUDA、ROCm、XPU、MPS 和 Arm 平台的扩展支持
立即注册。
嘉宾
Andrey Talman Andrey Talman 是 Meta 的软件工程师,主要专注于 PyTorch 及其生态库的开源发布。他负责发布管理、持续集成和流程改进,确保 PyTorch 及相关项目的高质量及时交付。
Alban Desmaison Alban Desmaison 是 Meta 的研究工程师,也是 PyTorch 的核心维护负责人。
Joe Spisak Joe Spisak 是 Reflection AI 的产品副总裁兼开源负责人。他是 PyTorch 核心维护者,担任 PyTorch 基金会管理委员会成员,并曾任职于 Meta。
主持人
Chris Gottbrath Chris Gottbrath 是 Meta 支持 PyTorch 的技术项目经理,同时担任 PyTorch 基金会营销委员会主席。
相似文章
@PyTorch:PyTorch 2.13 来了,包含来自 526 位贡献者的 3,328 次提交,并更新了 FlexAttention、CuTeDSL、nn.LinearCros…
PyTorch 2.13 已发布,主要更新包括:Apple Silicon 上的 FlexAttention(速度提升高达 12 倍)、CuTeDSL 后端、可将显存减少 4 倍的 nn.LinearCrossEntropyLoss、新的 torchcomms 通信后端、FSDP2 通信重叠、Python 3.15 wheel 支持以及更广泛的平台支持。计划于 7 月 22 日进行现场问答。
@PyTorch: PyTorch 2.14 引入了对 Inductor、PyTorch Distributed、c10d、动态形状、Apple Silicon 和加速器等的更新
PyTorch 2.14 引入了对 Inductor、PyTorch Distributed、动态形状、Apple Silicon 支持等方面的更新,并有现场问答和 PyTorchCon 公告。
@PyTorch: PyTorch 2.12 在编译、导出、分布式训练和加速器支持方面引入重大更新。亮点…
PyTorch 2.12 版本包括对编译、导出、分布式训练和加速器支持的重大更新,CUDA 上批量化 linalg.eigh 速度提升高达 100 倍,并新增了 torch.accelerator.Graph 等 API。
PyTorch 2.12 版本亮点(7分钟阅读)
PyTorch 2.12 引入了显著的性能改进,包括在 CUDA 上实现高达 100 倍加速的批量本征分解、新的设备无关的 torch.accelerator.Graph API,以及在 torch.export 中支持微缩放量化,持续推动该框架向统一生产平台的演进。
@PyTorch:PyTorch基金会持续发展,作为一个多项目家园,致力于支持跨每个阶段的协作……
PyTorch基金会宣布推出新的季度博客系列,其托管项目(PyTorch、vLLM、DeepSpeed、Ray、Helion、Safetensors)分享更新。亮点包括PyTorch 2.13版本,带来性能改进和Apple Silicon优化,以及ExecuTorch和硬件支持方面的进展。