ROCm 7.13 夜间版新增 Strix Halo 优化
摘要
AMD 的 ROCm 7.13 技术预览版为 Strix Halo(Ryzen AI Max 300)新增优化,并将 ROCprof Trace Decoder 开源。
[https://www.phoronix.com/news/ROCm-7.13-Released](https://www.phoronix.com/news/ROCm-7.13-Released) 引用:...为 Ryzen AI Max 300 "Strix Halo" 新增优化,ROCprof Trace Decoder 现已开源...<snip>... 从源码编译的用户可通过 GitHub 上的 [TheRock](https://github.com/ROCm/TheRock/releases/tag/therock-7.13) 获取 ROCm 7.13 技术预览版。 [https://rocm.docs.amd.com/en/7.13.0-preview/about/release-notes.html](https://rocm.docs.amd.com/en/7.13.0-preview/about/release-notes.html) 冷知识:ROCm 名称源于 Radeon Open Compute Module。
相似文章
Strix Halo ROCm + MTP 笔记 (2026年5月)
技术基准测试,比较 ROCm 和 Vulkan 后端在 Strix Halo 硬件上运行 LLM 推理的性能,MTP 合并到 llama.cpp 之后,结果显示 ROCm 在全上下文时性能严重下降,而 Vulkan 保持稳定。
AMD ROCm 7.14 "TheRock" 技术预览已发布,针对最新 AMD GPU 计算堆栈
AMD 发布了 ROCm 7.14 'TheRock' 技术预览,带来了AI训练增强、针对Comfy UI等特定AI工作负载的性能提升高达16%,以及对开源GPU计算堆栈的持续Windows支持。
AMD / Strix Halo+ 用户的大新闻
AMD Strix Halo 设备上的 NPU 现在可用于 AI 推理,支持混合模式,结合 NPU 和 iGPU 以实现更快的提示处理。Lemonade 和 AMD 的 ROCm 等软件使之成为可能。
@pupposandro: https://x.com/pupposandro/status/2054241934164492328
该文章宣布了 llama.cpp 对 AMD Strix Halo 集成 GPU (iGPU) 上的 DFlash 和 PFlash 投机解码的支持,并展示了使用 ROCm 时推理性能的显著提升。
AMD Strix Halo RDMA 集群搭建指南
一份使用自定义 Docker/Podman 工具箱,借助 ROCm/RCCL RDMA 支持,将两个 AMD Strix Halo 节点集群化,以在 256GB 统一内存上通过张量并行启用 vLLM 的搭建指南。