标签
NVIDIA 推出了 ModelExpress,该工具利用 GPU 到 GPU 的 RDMA 传输和优化的存储流式传输,加速了跨 GPU 集群的模型制品分发,将 DeepSeek-V4 Pro 等大型模型的启动时间从 8 分钟缩短至不到 2 分钟。
NVIDIA 推出 ModelExpress,一种用于快速分发 AI 模型工件的解决方案,如其技术博客所述。
一个用于共享开放模型.torrent文件的仓库和网站,使用Hugging Face作为Web种子后备,实现无对等点下载。
Noema Atlas是一款免费的开源点对点桌面应用程序,用于LLM模型权重的去中心化分发,使用内容寻址验证和Iroh实现直接的机器间传输,并以Hugging Face作为后备。