@rohanpaul_ai: 据The Information报道,继DeepSeek之后,智谱AI也在探索定制ASIC,因其GLM-5.2的使用量据报道增长了27倍…
摘要
智谱AI正在继DeepSeek之后探索定制ASIC,因为GLM-5.2的使用量在一周内增长了27倍,凸显了中国AI行业向大规模推理专用硬件的转变。
查看缓存全文
缓存时间: 2026/07/07 19:36
据《The Information》报道,在DeepSeek之后,智谱AI也在探索定制ASIC——其GLM-5.2的使用量据说一周内暴涨了27倍。
定制ASIC虽然会牺牲灵活性,但能降低功耗和单次token的成本。
英伟达GPU是强大的通用计算设备,但大规模推理的经济逻辑有所不同。如果模型固定,围绕其重复运算设计的芯片能实现更优性能。
智谱尚未选定合作伙伴,该项目可能需要两年以上时间。
这一趋势已超越单一中国实验室或模型发布。中国AI企业正试图让软件、硬件和部署更加密不可分。
Rohan Paul (@rohanpaul_ai): DeepSeek正在打造一款推理芯片,以减少在500亿美元的中国AI芯片市场中对英伟达和华为的依赖。
DeepSeek的芯片研发尚处早期阶段,涉及外部合作伙伴及私下招募芯片设计工程师。
困难不在于绘制芯片图纸,而在于实现大规模量产。
相似文章
巴伦周刊报道了中国人工智能公司智谱AI和DeepSeek的支出策略,重点介绍了它们在竞争激烈的人工智能领域的财务动向。
巴伦周刊报道了中国人工智能公司智谱AI和DeepSeek的支出策略,重点介绍了它们在竞争激烈的人工智能领域的财务动向。
智谱股价飙升33%,华尔街因Anthropic受限而加大对中国AI的押注
中国AI开发商智谱的股价一度上涨48%,此前华尔街银行上调了目标价,且美国对Anthropic模型的限制提振了对中国替代方案的需求。智谱宣布开源其GLM-5.2模型。
Z.ai 完全在中国AI芯片上运行GLM-5.3-Flash
Z.ai宣布,其完全在中国AI芯片上运行了GLM-5.3-Flash模型,每个token的成本与Nvidia GPU相当,并使用了一个针对内存受限硬件优化的自定义推理引擎。
@rohanpaul_ai: Zhipu创始人Tang Jie的精彩文章。AI扩展正在超越参数增长。“有多少参数?”正变得……
Zhipu创始人Tang Jie讨论了AI扩展如何超越参数数量,涵盖训练数据、每次前向传播的计算量以及后训练等因素,并以GLM-5.3为例。
Z.ai 建造了一个千兆瓦级人工智能数据中心(3分钟阅读)
Z.ai 完成了一个完全由中国制造芯片供电的千兆瓦数据中心,扩大了用于训练其先进 GLM 模型的计算基础设施。