@bookwormengr: 关于CANN(华为版的CUDA)及DeepSeek V4在华为芯片上推理的精彩报道……“CANN(神经网络计算架构)
摘要
华为已开源其CANN软件工具包,以与Nvidia的CUDA竞争,而DeepSeek V4在华为昇腾芯片上显示出显著的推理性能提升。
查看缓存全文
缓存时间: 2026/06/10 11:49
关于CANN(华为版CUDA)以及DeepSeek V4在华为芯片上的推理表现,这是一篇非常精彩的报道……
“CANN(神经网络计算架构)是华为在其自研昇腾芯片上运行AI工作负载的软件工具包。自2025年8月起,华为将CANN开源,旨在吸引更多开发者,并逐步削弱英伟达的主导地位——尤其在中国市场,因为美国政府严格限制搭载CUDA的芯片向中国出口。”
SemiAnalysis (@SemiAnalysis_): DeepSeekV4 1.6T 从第0天到第43天的性能变化 —— 华为、GB300 NVL72、MI355X、B200 第0天在InferenceX上的推理性能 26天内性能提升100倍 每百万Token成本 华为950DT推理跟踪分析
相似文章
DeepSeek的Huawei芯片训练声明终于有了基准测试和质疑者(3分钟阅读)
一个由华为主导的联合体发布了基准测试,显示在Ascend芯片上对DeepSeek的V4模型进行高效后训练,但专家指出这仅涵盖后训练,并不能证明华为可以替代英伟达进行完整的预训练。
又一个‘DeepSeek时刻’?分析师称华为里程碑改变中国芯片竞赛轨迹
华为推出Tau缩放定律,这是一种绕过美国制裁的芯片架构变通方案,旨在到2031年实现相当于1.4纳米工艺的晶体管密度,标志着中国半导体自给自足迈出重要一步,并改变了与华盛顿的技术竞争格局。
@bookwormengr: https://x.com/bookwormengr/status/2072421710692028900
美团的长颈鹿实验室(LongCat Lab)如何利用华为的910C AI芯片和CloudMatrix超级集群训练出长颈鹿2.0(LongCat 2.0)模型的分析,展现了中国AI生态系统如何克服美国出口管制。文章强调了美团向AI驱动的超级生活应用的战略转型,以及华为在AI工厂基础设施方面的创新。
@rohanpaul_ai: 路透社:DeepSeek 已将其 V4-Pro 的价格削减永久化,将价格降至原始 API 成本的 25%。Deep…
路透社报道称,DeepSeek 已将其 V4-Pro API 的价格削减永久化,成本降至原价的 25%,这归因于在中国 AI 硬件战略背景下,从英伟达芯片转向华为芯片。
@wafer_ai: 6家NVIDIA竞争对手都发现了CUDA的同一个弱点 @gpuemi 撰写了关于6家NVIDIA竞争对手的深度分析。不同的...
一个线程分析了六家AI芯片竞争对手(Tenstorrent、Cerebras、Trainium、TPU、SambaNova、Furiosa)如何都独立放弃了传统GPU的特性,如硬件缓存和线程,转而使用软件管理的SRAM和不同的编程模型,与NVIDIA的CUDA方法形成对比。