@rohanpaul_ai:NVIDIA的非独占Groq许可协议8个月后,Groq技术终于出现在机架规模的……
摘要
NVIDIA正在将Groq技术集成到机架规模的产品中,以通过跨专业处理器分配工作负载来增强代理AI性能,改善令牌生成延迟和整体响应性。
查看缓存全文
缓存时间: 2026/08/25 20:09
NVIDIA与Groq达成非独家授权协议仅8个月后,Groq技术现已融入NVIDIA的机架级产品。
Groq机架设备将于今年投入运行。
这意味着NVIDIA正将智能体AI工作负载分散到专用处理器上,而非仅依赖GPU承担全部任务。
其中Rubin GPU负责重型模型计算,Groq 3 LPX专攻低延迟的token生成,而Vera CPU将处理模型外围的代码执行、工具调用、数据处理与模拟仿真。
在智能体场景中,token生成延迟的影响远超普通对话模式——因为后续步骤往往需要等待前序任务完成。
NVIDIA宣称Groq 3 LPX相比Cerebras推理平台可实现4倍响应速度提升,这种优势将在长任务链中产生累积效应,而不仅仅是让单次响应显得更快。
正因为如此,推理硬件正开始按工作负载类型走向细分化发展。
相似文章
Groq在英伟达交易后筹集3.5亿美元(4分钟阅读)
Groq在英伟达授权技术并招聘其高级团队后,以35亿美元估值筹集了3.5亿美元,并转向使用LPUs和英伟达系统的推理云业务。
Groq如何筹集更多资金?
尽管Groq将其技术授权给Nvidia,但公司实体保留了其数据中心运营和推理API,专注于快速的小模型推理,因此正在筹集6.5亿美元。
Groq 3 LPX全面投产,NVIDIA扩展Vera Rubin代理推理平台
NVIDIA宣布Groq 3 LPX现已全面投产,通过Vera Rubin平台为代理AI系统提供超快令牌生成能力,基准测试显示性能提升4倍。
Groq 融资 3.5 亿美元,推动 AI 芯片向 neocloud 转型
Groq 获得 3.5 亿美元融资,以从 AI 芯片制造转向 neocloud 服务,提供基于 GPU 的 AI 基础设施,Nvidia 的参与使得公司估值达到 35 亿美元。
在英伟达200亿美元“非收购式招聘”之后,AI芯片初创公司Groq据悉正在融资6.5亿美元
AI芯片初创公司Groq据报正在从现有投资者处融资6.5亿美元,以发展其推理云业务,此前该公司与英伟达达成了一项200亿美元的技术授权协议。