KAKA WEB3News
黄仁勋最担心的事情正在发生:DeepSeek开始搬离美国主导的AI技术栈,底层组件集体适配华为昇腾
律动 BlockBeats·Sep 30, 2026 12:24 GMT+8
动察 Beating AI 快讯,DeepSeek 联合华为,把一整套 AI 训练和推理底层组件搬上了昇腾。新开源的工具覆盖算子开发、矩阵计算、跨卡通信、Attention 和数据筛选,基本对应 DeepSeek 此前为英伟达 GPU 打造的那套底层工具。路透社称,这是中国科技公司寻找英伟达生态替代方案的最新进展。 这里最关键的是 TileLang。DeepSeek V4 训练中的大量算子已经用它实现。它解决的是一个很底层的问题:开发者怎么把模型里的计算,真正高效地跑在芯片上。过去这套能力高度围绕 CUDA 建立,现在 DeepSeek 和华为正在给昇腾补上对应版本。 这正好击中黄仁勋几个月前最担心的事情。今年 4 月,他在 Dwarkesh Patel 的播客里说,如果有一天 DeepSeek 率先在华为芯片
动察 Beating AI 快讯,DeepSeek 联合华为,把一整套 AI 训练和推理底层组件搬上了昇腾。新开源的工具覆盖算子开发、矩阵计算、跨卡通信、Attention 和数据筛选,基本对应 DeepSeek 此前为英伟达 GPU 打造的那套底层工具。路透社称,这是中国科技公司寻找英伟达生态替代方案的最新进展。 这里最关键的是 TileLang。DeepSeek V4 训练中的大量算子已经用它实现。它解决的是一个很底层的问题:开发者怎么把模型里的计算,真正高效地跑在芯片上。过去这套能力高度围绕 CUDA 建立,现在 DeepSeek 和华为正在给昇腾补上对应版本。 这正好击中黄仁勋几个月前最担心的事情。今年 4 月,他在 Dwarkesh Patel 的播客里说,如果有一天 DeepSeek 率先在华为芯片上发布,对美国会是一个「糟糕的结果」。他担心的从来不只是华为芯片本身,而是模型开始围绕华为架构优化。一旦全球开发者拿到同一个模型时,默认在非美国硬件上跑得更好,美国芯片的优势就会被一点点削弱。 DeepSeek 随后的动作几乎沿着这条路径展开。V4 已经开始适配昇腾 950,华为还称自家芯片参与了部分 V4 训练。《The Information》上周又披露,梁文锋已把增加国产芯片训练列为 DeepSeek 的重点押注,并预计最早第四季度拿到新的华为训练芯片。 现在补上的是软件这一层。从模型适配,到训练芯片,再到矩阵计算、MoE 通信、Attention 和算子开发,DeepSeek 正在把过去严重依赖英伟达和 CUDA 的一部分底层能力,逐步迁到华为昇腾上。 中美 AI 博弈过去竞争的是谁的模型更强、谁有更多 GPU;现在开始变成,谁能建立一整套从芯片、算子、通信到训练框架的技术栈。CUDA 过去最难替代的,从来不是一张显卡,而是围绕它长出来的整套软件。DeepSeek 和华为现在补的,正是这一层。
Public content from Kaka Web3. Market and digital-asset information is not investment advice.