@rohanpaul_ai: 几乎所有AI云都基于NVIDIA运行。General Compute希望成为运行其他一切系统的平台:Cerebras、Sam…

X AI KOLs Timeline 新闻

摘要

General Compute正与NVIDIA GPU一起部署Cerebras系统,提供20倍更快的AI推理,资金来自4亿美元债务,以解决开发者的计算可用性问题。

几乎所有AI云都基于NVIDIA运行。 General Compute希望成为运行其他所有系统的平台:Cerebras、SambaNova、Etched。 他们的第一个大动作是大量购买Cerebras,资金来自4亿美元的债务。这些机器将与NVIDIA GPU并排放置,每个请求会在它们之间分配。 GPU读取提示。Cerebras生成答案,速度很快,因为权重存储在片上SRAM中,所以解码不会因内存带宽而停滞。
查看原文
查看缓存全文

缓存时间: 2026/09/30 02:02

几乎所有AI云服务都依赖NVIDIA运行。

而General Compute则立志成为运行一切其他系统的平台:包括Cerebras、SambaNova和Etched。

他们的首个重大举措是通过4亿美元债务融资大规模采购Cerebras设备。这些机器将与NVIDIA GPU并肩部署,每个计算请求会在两者间分配处理。

GPU负责读取提示词,Cerebras则负责生成答案——其速度优势源于权重直接存储在片上SRAM中,使得解码过程不受内存带宽限制。

General Compute (@general_compute): 🚨重大消息:我们兴奋地宣布,将通过与@Cerebras合作部署全球最快的推理系统。

任何开发者听到20倍加速的AI都会振奋不已…但现实是可用算力极其稀缺。

我们要解决的正是这个问题。

采用GPU处理前缀阶段——

相似文章

通用计算

Product Hunt

通用计算是一款产品,提供针对速度优化的推理云,用于运行AI模型。

OpenAI与Cerebras合作

OpenAI Blog

OpenAI与Cerebras合作,将750MW超低延迟AI计算能力整合到其平台中,旨在加速推理,并在各种工作负载中实现更快的实时AI响应。