@rohanpaul_ai: 几乎所有AI云都基于NVIDIA运行。General Compute希望成为运行其他一切系统的平台:Cerebras、Sam…
摘要
General Compute正与NVIDIA GPU一起部署Cerebras系统,提供20倍更快的AI推理,资金来自4亿美元债务,以解决开发者的计算可用性问题。
查看缓存全文
缓存时间: 2026/09/30 02:02
几乎所有AI云服务都依赖NVIDIA运行。
而General Compute则立志成为运行一切其他系统的平台:包括Cerebras、SambaNova和Etched。
他们的首个重大举措是通过4亿美元债务融资大规模采购Cerebras设备。这些机器将与NVIDIA GPU并肩部署,每个计算请求会在两者间分配处理。
GPU负责读取提示词,Cerebras则负责生成答案——其速度优势源于权重直接存储在片上SRAM中,使得解码过程不受内存带宽限制。
General Compute (@general_compute): 🚨重大消息:我们兴奋地宣布,将通过与@Cerebras合作部署全球最快的推理系统。
任何开发者听到20倍加速的AI都会振奋不已…但现实是可用算力极其稀缺。
我们要解决的正是这个问题。
采用GPU处理前缀阶段——
相似文章
通用计算
通用计算是一款产品,提供针对速度优化的推理云,用于运行AI模型。
@CNET:Nvidia GTC 2026,黄仁勋谈“AI原生”投资
Supermicro 与 NVIDIA 发布交钥匙“AI Factory”参考架构,整合 Blackwell GPU、认证服务器、网络、存储与部署服务,让企业更快搭建集群级 AI 基础设施。
为何首批GPU融资者转向推理芯片达成4亿美元交易
General Compute以推理专用SambaNova芯片作为抵押,从Upper90获得4亿美元贷款,这标志着AI基础设施融资正在转向更便宜、更高效的推理硬件,以应对日益增长的开源模型需求。
NVIDIA AI Cloud 生态系统全球扩展以满足全球AI计算需求
NVIDIA宣布与其合作伙伴在六大洲扩展AI Cloud生态系统,以满足全球AI计算需求,通过全栈AI基础设施支持训练、推理和自主AI工作负载。
OpenAI与Cerebras合作
OpenAI与Cerebras合作,将750MW超低延迟AI计算能力整合到其平台中,旨在加速推理,并在各种工作负载中实现更快的实时AI响应。