国产GPU的“分水岭”:跑通万卡集群,才有资格谈未来
2026-09-08 · tc-giraffe.com
9月7日,国产GPU龙头摩尔线程迎来限售股上市流通,盘面出现阶段性波动,引发市场的关注。但穿透短期盘面情绪、看懂当下AI算力行业的核心竞争逻辑,就会明白: 短期的流动性扩容与筹码换挡,并不会改变公司的核心产业底牌与基本面航向。 当下的国产GPU行业,早已告别“比拼单卡纸面参数”的初级阶段,大模型竞赛进入下半场,算力竞争逻辑彻底改写。行业早已形成共识:万卡集群
9月7日,国产GPU龙头摩尔线程迎来限售股上市流通,盘面出现阶段性波动,引发市场的关注。但穿透短期盘面情绪、看懂当下AI算力行业的核心竞争逻辑,就会明白: 短期的流动性扩容与筹码换挡,并不会改变公司的核心产业底牌与基本面航向。
当下的国产GPU行业,早已告别“比拼单卡纸面参数”的初级阶段,大模型竞赛进入下半场,算力竞争逻辑彻底改写。行业早已形成共识:万卡集群是国产GPU的生死分水岭,跑通大规模商用集群,才有资格留在AI算力牌桌、谈论未来成长;跑不通,再华丽的单卡参数都是空谈。
当整个行业还在争论国产GPU“能不能用”时,摩尔线程早已跨过“好用”的核心门槛,成为国内除华为昇腾外,唯一真正跑通万卡级大模型训练集群、实现商业化落地的国产GPU厂商。如此硬核的行业壁垒与成长实力,不应被一次常规的解禁流动性释放所遮蔽。
先说一个残酷的现实:从千卡到万卡,工程难度是指数级增长的。
大规模训练对芯片、互联、通信库及软件框架的协同稳定性要求极高,集群中任何单点故障都可能导致持续数周的训练任务中断。这也是为什么过去国产GPU更多用于推理——大规模训练的门槛,比大多数人想象的高得多。
截至2026年中,国产GPU企业中,真正实现万卡级集群商业化落地的,只有摩尔线程。多数厂商目前的规模化交付仍停留在单点千卡或数千卡级别,单体万卡集群的大规模商业落地仍处于攻坚阶段。
摩尔线程是国内除华为外,唯一实现万卡级大模型训练集群落地的GPU厂商。 这句话没有水分,背后是一整套通信互联与系统工程能力的沉淀。
二、数据不会说谎:从“能用”到“好用”
判断一个集群“好用”还是“能用”,看三个指标就够了:线性扩展效率、有效训练时长、模型精度对齐。
依托全功能GPU架构,摩尔线程夸娥智算集群通过完备的训练套件、领先的训练优化及强化学习技术,交出的答卷是:
线性扩展效率95% ——这意味着每增加一张卡,几乎都能带来等比例的算力提升,没有“加卡不加力”的尴尬。
有效训练时长占比超90% ——在万卡规模下,集群能稳定运行,不需要频繁中断重启。无锡移动相关负责人直言:“这在国内大规模集群里是很优秀的水平,让我们对国产方案更有信心。”
模型精度与国际主流GPU高度一致 ——在DeepSeek类MoE模型上,前3万步的平均相对误差控制在万分之六以内。MMLU评测精度与训练损失曲线同国际主流计算卡高度一致。
这些指标绝非纸面参数,而是经受住了真实的“国芯训国模”实测:夸娥集群不仅从零起步完整训练出超25万亿Token级MoE-236B大模型,全栈原生跑通北大5D世界模型EvoPhys-World,全流程验证具身大脑模型RoboBrain2.5——超大规模、超长周期的连续稳定训练,夸娥集群已切实跑通全链路闭环。
这三个代表性模型放在一起,结论只有一个:摩尔线程的万卡集群已经具备了承接大规模商业化算力需求的真实能力,更展现出极强的通用训练属性。
无锡(惠山)国产智算中心就是最好的证明:今年6月正式点亮,短短三个月内基本满载运行,超20家客户在集群上测试或正式使用,覆盖政府机关、高校、顶尖科研院所和制造业头部企业。从基建落地到商业化应用,这条路走通了。
三、被低估的“杀手锏”:异构协同效率
如果万卡集群是硬件能力的证明,那异构协同就是摩尔线程被市场严重低估的软硬协同能力。
大模型推理分为Prefill(预填充)和Decode(解码)两个阶段——前者重计算,后者重带宽。摩尔线程的方案是:让S5000干它最擅长的事——Prefill阶段的大规模矩阵计算和KV Cache生成,把访存密集的Decode交给高带宽GPU。
在Kimi K2.6真实生产集群上, 2台S5000等效替代1台 英伟达 高端GPU ,全链路服务质量不打折。这个数据出自摩尔线程与硅基流动发布的《PD分离异构算力混部实践技术白皮书》,国产GPU只要按2比1的比例去部署,就能撑起跟 英伟达 高端卡一样的推理能力。
换言之,过去堆4张英伟达才能干的活,现在只需要2张英伟达加上4张摩尔线程,就能跑出同等甚至更优的效果。Token照样产,延迟照样稳,服务质量不打折。
这已经超越了单纯“替代补位”的范畴——这是在用更优的TCO(总体拥有成本),释放更高的算力产出。
在国产GPU异构混合部署领域,摩尔线程展现出的协同效率与工程打磨能力,已成为其最具辨识度的竞争壁垒之一。
2026年上半年,摩尔线程实现营业收入17.36亿元,同比增长147.42%——半年收入已超2025年全年;2026年3月,签订6.6亿元的夸娥智算集群销售合同;上半年已导入互联网头部企业及电信运营商等关键领域客户。
国产GPU行业正在经历一场由参数竞争走向工程交付的洗牌。“能不能用”已经是过去式,“好不好用”、能不能跑通大集群才是现在的考题。
摩尔线程用万卡集群的落地、95%的线性扩展效率、90%以上的有效训练时长,以及国内领先的异构协同效率,证明了自己已经从“验证备选”变成了“主力担当”。
跑通万卡集群,才有资格谈未来——短期的筹码换手自会平复,但深筑在集群工程与全栈生态里的硬核壁垒,才是支撑企业穿越周期的真正内核。 $摩尔线程-U(SH688795)$