2026年中ROCm状态 [D]

Reddit r/MachineLearning 新闻

摘要

作者询问2026年中AMD的ROCm生态系统在AI训练领域的当前可行性,将其与NVIDIA的CUDA进行比较,并询问它是否已达到PyTorch的“开箱即用”阶段。

嘿,朋友们,我开始听说ROCm现在推理效果不错。但是,我还没有看到任何关于它训练可行性的报告。我目前用几张RTX 3090来搭建模型原型,但我正在考虑换成一对RX7900XTX。至少从纸面上看,RX7900XTX在FP16下的吞吐量大约是RTX 3090的四倍,功耗、显存和成本却差不多。根据PyTorch文档,ROCm现在似乎完全受支持,但我很难找到用户报告说PyTorch在ROCm上运行的效果如何。现在切换到ROCm的可行性有多大?它是否已经到了"开箱即用"的阶段?还是说AMD的生态系统仍然明显落后于CUDA?
查看原文

相似文章