gpu-pooling

标签

Cards List
#gpu-pooling

CEA架构比我最初想象的更重要

Reddit r/LocalLLaMA · 2026-09-10

文章讨论了CEA架构作为一个重要的推理飞跃,强调了其编码器/解码器分离以及在异构设置中创新性GPU池化的潜力。

0 人收藏 0 人点赞
#gpu-pooling

@PyTorch: 随着模型复杂性和多智能体工作负载的不断增长,Trong Vinh Nguyen 解释了 Viettel 如何将混乱的现实统一为一个单一平台…

X AI KOLs Timeline · 2026-09-09

Trong Vinh Nguyen 解释了 Viettel 如何通过叠加来自 Open Infradev、Cloud Native Foundation 和 PyTorch Foundation 的开源生态系统,创建了一个 Token-as-a-Service 平台,以统一多智能体工作负载的 GPU 管理。

0 人收藏 0 人点赞
#gpu-pooling

Mesh LLM:基于iroh的分布式AI计算

Hacker News Top · 2026-07-11 缓存

Mesh LLM 是一个分布式AI计算平台,它聚集多台机器上的闲置GPU来运行大型语言模型,并暴露单一的OpenAI兼容API。该平台利用iroh的点对点网络,实现无需中央服务器的私有、去中心化推理。

0 人收藏 0 人点赞
#gpu-pooling

联合所有GPU来训练一个社区模型

Reddit r/LocalLLaMA · 2026-06-16

关于从社区汇集GPU以训练大规模AI模型的讨论,质疑其可行性以及现有项目,尽管存在已知瓶颈如延迟和权重中毒。

0 人收藏 0 人点赞
← 返回首页

提交意见反馈