amd-gpus

标签

Cards List
#amd-gpus

@PyTorch: AMD has been upstreaming optimizations for improved FP8 training support in PyTorch/TorchTitan and PyTorch/TorchAO, mak…

X AI KOLs Timeline ↗ · 2026-08-13 缓存

AMD upstreamed optimizations to PyTorch/TorchTitan and TorchAO for FP8 training on AMD Instinct GPUs, achieving up to 13.4% throughput gains on Llama3-8B and recovering 89% of FP8 quantization overhead on DeepSeek-V3 via fused Triton kernels.

0 人收藏 0 人点赞
#amd-gpus

将 PyTorch Monarch 移植到 AMD GPU:在 ROCm 上进行单控制器分布式训练(13 分钟阅读)

TLDR AI ↗ · 2026-07-07 缓存

本文描述了将分布式训练运行时 PyTorch Monarch 移植到基于 ROCm 的 AMD GPU 的过程,实现了大规模单控制器容错训练,并解决了大规模 LLM 训练中的可靠性挑战。

0 人收藏 0 人点赞
#amd-gpus

面向AMD GPU的更好HIP内核生成:合成数据、多智能体搜索与强化学习

Reddit r/LocalLLaMA ↗ · 2026-07-02 缓存

探讨了合成数据生成、多智能体优化和强化学习,以提高语言模型为AMD GPU生成高性能HIP内核的能力,并在MI350X上展示了编译率和正确率的提升。

0 人收藏 0 人点赞
#amd-gpus

ZAYA1-74B-Preview:在AMD上扩展预训练

Reddit r/LocalLLaMA ↗ · 2026-05-07 缓存

Zyphra发布ZAYA1-74B-Preview,一个在AMD硬件上训练的740亿参数基础模型,强调了强大的预强化学习推理能力和智能体性能信号。

0 人收藏 0 人点赞
← 返回首页

提交意见反馈