华为：昇腾超节点系列产品全面支持 DeepSeek V4

2026-04-24 发布浏览350次点赞0次收藏0次

4 月 24 日消息，今天上午，DeepSeek-V4 模型预览版正式上线并同步开源。

官方随后宣布，通过双方芯模技术紧密协同，实现昇腾超节点全系列产品支持 DeepSeek V4 系列模型。

官方表示，昇腾 950 通过融合 kernel 和多流并行技术降低 Attention 计算和访存开销，大幅提升推理性能，结合多种量化算法，实现了高吞吐、低时延的 DeepSeek V4 模型推理部署。昇腾 A3 超节点系列产品也全面适配，同时为便于用户快速微调，提供了基于昇腾 A3 超节点的训练参考实现。

获悉，基于 DeepSeek V4-Pro 模型，在 8K 输入场景，昇腾 950 超节点可实现 TPOT 约 20ms 时单卡 Decode 吞吐 4700TPS。DeepSeek V4-Flash 模型，8K 长序列输入场景下可实现 TPOT 约 10ms 时单卡 Decode 吞吐 1600TPS（上述 Benchmark 数据均基于 Offine 推理模式采集，不包含 Serving 调度和框架负载均衡影响）。

基于昇腾 A3 64 卡超节点结合大 EP 模式部署，DeepSeek V4-Flash 模型，8K/1K 输入输出场景，基于 vLLM 推理引擎可实现 2000+TPS 的单卡 Decode 吞吐，单卡吞吐持续提升。官方表示，针对 DeepSeek V4-Pro 模型，昇腾 A3 同步支持推理部署，性能持续优化中。

框架华为昇腾 DeepSeek V4 体验性能

声明：本文转载自IT 之家，转载目的在于传递更多信息，并不代表本社区赞同其观点和对其真实性负责，本文只提供参考并不构成任何建议，若有版权等问题，点击这里查看更多信息！

华为：昇腾超节点系列产品全面支持 DeepSeek V4

aizws = AI 中文社

欢迎来到 AI 中文社区（简称 AI 中文社），这里是学习交流 AI 人工智能技术的中文社区。按下 Ctrl+D 或 ⌘+D 收藏本站。

aizws = AI 中文社

欢迎来到 AI 中文社区（简称 AI 中文社），这里是学习交流 AI 人工智能技术的中文社区。 按下 Ctrl+D 或 ⌘+D 收藏本站。

欢迎来到 AI 中文社区（简称 AI 中文社），这里是学习交流 AI 人工智能技术的中文社区。按下 Ctrl+D 或 ⌘+D 收藏本站。