DeepSeek开源华为昇腾芯片编程工具,核心是TileLang
DeepSeek与华为联合发布面向昇腾芯片的开源编程工具,包含计算与芯片间数据传输库,并优化了 128 颗昇腾 950 芯片组成的超节点;核心语言TileLang源自北京大学研究者的工作。
DeepSeek与华为合作,为华为昇腾AI芯片构建编程工具,并将全部软件开源。据Reuters报道,这批软件包括计算库和芯片间数据传输库;DeepSeek在官方微信公众号发文称,华为对这项工作“完全支持”。
发布的核心是TileLang,一种面向AI芯片的开源编程语言。它最初由北京大学的研究人员开发,DeepSeek已使用约一年。DeepSeek认为,想为AI芯片建立独立软件生态,首先需要一个通用、易编程又能发挥硬件完整性能的语言,而TileLang的编程模型比英伟达的CUDA更简单。据《纽约时报》报道,TileLang如今是DeepSeek推进通用人工智能(AGI)工作的主要工具。
两家公司还优化了一个“超节点”,即由 128 颗昇腾 950 芯片组成的集群。
TileLang先在旧款英伟达芯片上测试过
DeepSeek最初是在较老的英伟达芯片上测试TileLang的。该公司的主张是:为AI芯片搭建独立软件生态,前提是有一个既容易编程、又能跑满硬件性能的通用语言。
这一合作瞄准的是中国AI产业最棘手的问题之一:国产芯片需要能发挥其性能的软件。英伟达的主导地位不只来自芯片设计,还来自全球约 400 万名使用CUDA构建应用的开发者。这个生态被形容为AMD等竞争对手跨不过去的护城河,即便它们的硬件在纸面参数上不落下风。
华为在DeepSeek发布前两周推出新处理器
据《纽约时报》报道,到目前为止,Z.ai和Moonshot AI等中国模型厂商的行动快于中国芯片厂商。华为希望缩小这一差距。
在DeepSeek宣布合作的两周前,华为发布了新的AI处理器和超节点系统,并表示这些产品明年将广泛用于模型训练。华为也承认国内需求无法完全满足,因此计划减少海外芯片销量。
华为现任轮值董事长徐直军谈到美国出口管制时表示,公司不能接受一个取决于别人是否愿意向中国出售芯片的未来。
SemiAnalysis:CUDA护城河在减弱,但英伟达在智能体负载上仍领先
研究机构SemiAnalysis在测试OpenAI的推理芯片Jalapeño后,称CUDA护城河“可能已死”,理由是OpenAI能很快让新模型在自己的硬件上跑起来。在大多数测试场景中,Jalapeño的每瓦性能超过了英伟达的Blackwell。据SemiAnalysis称,OpenAI的模型也参与了这颗芯片的设计,而这些模型本身运行在英伟达GPU上。
分析人士也给出了限定条件:他们只测试了相对容易优化的场景,输入约 8000 个token、输出约 1000 个token;尚未运行AgentX基准,该基准衡量AI智能体处理多步骤任务的能力。而SemiAnalysis在 8 月发现,正是在这一项上英伟达明显领先。
分析还指出,以AMD当前的软件栈,即使AMD免费送硬件,英伟达按token计算的成本仍然更低。作者认为英伟达的持久优势不在硅片本身,而在把多颗芯片连成一个系统的软件。
华为芯片没有参与AgentX对比。但在早前对DeepSeek V4的分析中,SemiAnalysis指出,华为的CANN软件栈是除CUDA之外唯一在模型发布首日就提供支持的软件栈。