ROCm 7.13 夜间版新增 Strix Halo 优化

Reddit r/LocalLLaMA 工具

摘要

AMD 的 ROCm 7.13 技术预览版为 Strix Halo(Ryzen AI Max 300)新增优化,并将 ROCprof Trace Decoder 开源。

[https://www.phoronix.com/news/ROCm-7.13-Released](https://www.phoronix.com/news/ROCm-7.13-Released) 引用:...为 Ryzen AI Max 300 "Strix Halo" 新增优化,ROCprof Trace Decoder 现已开源...<snip>... 从源码编译的用户可通过 GitHub 上的 [TheRock](https://github.com/ROCm/TheRock/releases/tag/therock-7.13) 获取 ROCm 7.13 技术预览版。 [https://rocm.docs.amd.com/en/7.13.0-preview/about/release-notes.html](https://rocm.docs.amd.com/en/7.13.0-preview/about/release-notes.html) 冷知识:ROCm 名称源于 Radeon Open Compute Module。
查看原文

相似文章

Strix Halo ROCm + MTP 笔记 (2026年5月)

Reddit r/LocalLLaMA

技术基准测试,比较 ROCm 和 Vulkan 后端在 Strix Halo 硬件上运行 LLM 推理的性能,MTP 合并到 llama.cpp 之后,结果显示 ROCm 在全上下文时性能严重下降,而 Vulkan 保持稳定。

AMD / Strix Halo+ 用户的大新闻

Reddit r/LocalLLaMA

AMD Strix Halo 设备上的 NPU 现在可用于 AI 推理,支持混合模式,结合 NPU 和 iGPU 以实现更快的提示处理。Lemonade 和 AMD 的 ROCm 等软件使之成为可能。

AMD Strix Halo RDMA 集群搭建指南

Hacker News Top

一份使用自定义 Docker/Podman 工具箱,借助 ROCm/RCCL RDMA 支持,将两个 AMD Strix Halo 节点集群化,以在 256GB 统一内存上通过张量并行启用 vLLM 的搭建指南。