fp8-training

标签

Cards List
#fp8-training

@PyTorch: AMD has been upstreaming optimizations for improved FP8 training support in PyTorch/TorchTitan and PyTorch/TorchAO, mak…

X AI KOLs Timeline · 2026-08-13 缓存

AMD upstreamed optimizations to PyTorch/TorchTitan and TorchAO for FP8 training on AMD Instinct GPUs, achieving up to 13.4% throughput gains on Llama3-8B and recovering 89% of FP8 quantization overhead on DeepSeek-V3 via fused Triton kernels.

0 人收藏 0 人点赞
#fp8-training

@_akhaliq: A.X K2 刚刚在 Hugging Face 上发布 大规模稀疏MoE (688B / 33B 激活参数) https://huggingface.co/skt/A.X-K2

X AI KOLs Following · 2026-07-29 缓存

SKT 在 Hugging Face 上发布了 A.X K2,一个 688B 参数的稀疏 MoE 语言模型,拥有 33B 激活参数,原生采用 FP8 训练,并具备 Think/Non-Think 推理模式。

0 人收藏 0 人点赞
← 返回首页

提交意见反馈