How Huawei’s AI chips outperform Nvidia’s in running DeepSeek’s R1 model | 华为AI芯片在运行DeepSeek R1模型中优于英伟达

华为技术的先进数据中心架构CloudMatrix 384,已使其Ascend芯片在运行DeepSeek的R1人工智能(AI)模型时,性能超过了英伟达的H800图形处理单元(GPU),这是由华为与中国AI基础设施初创公司硅流共同撰写的一份技术论文中提到的。该论文将CloudMatrix 384描述为一种专门为处理大规模AI工作负载而设计的“AI超级节点”。

根据论文,华为预计CloudMatrix“将重塑AI基础设施的基础”。它由384个Ascend 910C神经处理单元(NPU)和192个鲲鹏服务器中央处理器组成,通过统一总线连接,提供超高带宽和低延迟。基于此基础架构,华为推出的先进大语言模型(LLM)服务方案CloudMatrix-Infer,在运行DeepSeek的6710亿参数推理模型时,性能超过了全球一些最先进的系统。这一架构体现了华为在美国制裁措施下,推动AI系统性能突破的努力。

via SCMP Full Text Feed
 
 
Back to Top