ultra-low-latency

标签

Cards List
#ultra-low-latency

AMD与Cerebras推出AI推理解决方案(10分钟阅读)

TLDR AI · 昨天 缓存

AMD与Cerebras宣布联合推出AI推理解决方案,该方案将AMD Helios机架级解决方案与Cerebras晶圆级引擎相结合,旨在实现超低延迟和高吞吐量。这种解耦式推理工作流预计每瓦每秒可处理的token数量提升高达5倍。

0 人收藏 0 人点赞
← 返回首页

提交意见反馈