标签
Kimi K3 完整模型在 16x GB10 集群上运行,平均每秒处理 20+ 个 token,并计划发布 vllm 镜像和说明。
一份关于构建全球首批AMD Ryzen AI Halo处理器集群的报告,尽管具有新颖性,但结果令人失望。
IneffableLabs收到了来自Google Cloud和NVIDIA的首批Vera Rubin NVL72集群,标志着AI硬件的飞跃。
作者吐槽使用SSH和VPN访问大学HPC集群进行计算化学的笨拙之处,认为这种摩擦阻碍了独立研究人员开展工作,并倡导本地计算。
作者使用65536个低成本RISC-V微控制器(CH570)自制了一个GPU类并行计算集群,实现了QVGA分辨率渲染,并解决了电源、散热和编程自动化等工程挑战。
一位硬件爱好者使用8192个RISC-V微控制器(CH570)构建了一个浸没式冷却的超级集群,并分享了在时钟、SPI信号和产能方面的挑战与解决方案。
一份使用自定义 Docker/Podman 工具箱,借助 ROCm/RCCL RDMA 支持,将两个 AMD Strix Halo 节点集群化,以在 256GB 统一内存上通过张量并行启用 vLLM 的搭建指南。
SkyPilot Sandboxes 允许AI团队在自己的集群上运行沙盒,相比Modal可节省4-10倍成本,支持亚秒级启动和温池。
一篇博客文章指导读者如何搭建树莓派集群进行分布式训练和推理,这是系列教程的一部分,旨在利用实惠的硬件让分布式AI变得可及。