超节点爆发:中国AI算力基础设施进入规模化落地新阶段

0 次阅读 2026年07月27日

超节点不是概念,而是正在批量交付的算力底座

超节点正从实验室走向产线,从旗舰展示走向规模部署。2025年下半年起,国内头部互联网企业已明确启动超节点采购与部署计划。它不再是少数厂商的技术秀,而成为AI基础设施建设的必选项——原因很简单:在物理空间受限、电力与散热承压、Token成本亟需下探的现实约束下,传统服务器集群模式已逼近效能天花板,超节点以更高算力密度、更低单位算力能耗和更优跨卡通信效率,成为当前最可行的工程解法。

本质是算力组织方式的重构

超节点的核心,并非简单堆叠更多GPU或加速卡,而是通过高速互联(如NVLink、CXL、自研互连协议)、统一内存池、协同散热与智能调度软件,将数十至数千张计算卡整合为逻辑上的一台“超级计算机”。它突破了传统多机集群中跨节点通信带宽低、延迟高、拓扑复杂导致的算力损耗问题。实测数据显示:同等卡数下,超节点在PD分离推理场景中性能可提升30%–50%,训练任务中有效算力利用率显著高于分散部署模式。

三条技术路径并行演进

当前国产超节点已形成清晰的三类实践方向: 第一类是“大节点派”,聚焦单域极致规模与内存容量。华为昇腾950超节点已实现1024卡真机部署,今年Q4将交付8192卡版本;中科曙光640卡浸没式液冷超节点支撑的“曙光8000”十万卡集群已在国家超算互联网郑州节点满载运行;百度天池超节点正从256卡升级至512卡,全栈自研互联协议与液冷系统,已支撑文心5.1全国产训练及能源、电力等80+行业推理场景。 第二类是“弹性节点派”,强调部署灵活性与云化适配。阿里云灵骏真武M890以64卡为Scale-up单元,支持横向Scale-out扩展,并首次将超节点能力纳入公共云服务;浪潮信息推出32卡与64卡双规格产品,定位万亿参数模型推理,内部已用于AI Coding提效验证;沐曦曦景S600基于单柜64卡架构,兼顾CUDA生态兼容性与万卡集群扩展能力。 第三类是“架构突破派”,尝试绕开主流加速芯片生态。清微智能采用可重构数据流架构,芯片兼具计算与路由功能,无需交换机即可直连,已落地4096卡、500PFLOPS超节点,覆盖金融、国央企等关键场景;东方算芯于7月发布同类架构新品;摩尔线程、寒武纪亦明确将在新一代芯片平台集成超节点方案。

爆发背后有三重确定性驱动

其一,模型规模倒逼硬件重构。Kimi已发布2.8万亿参数模型,业内普遍预期春节前后将迈入3万亿,后续向6万亿、10万亿演进。训练端,1万亿模型约需5000卡,3万亿需万卡级集群——唯有紧耦合超节点能保障通信效率与内存一致性。推理端,AI Agent任务调用频次达数十万级,长上下文生成对显存带宽与并发吞吐提出全新要求,超节点的大内存池与低延迟互联成为刚需。 其二,综合成本账已算通。虽然单台超节点整机价格高于同卡数服务器,但其节省的机房空间、供电冗余、制冷设备与运维人力,使TCO(总拥有成本)更具优势。浪潮测算显示:推理性能提升10倍时,功耗仅增2倍;昆仑芯指出,传统10台服务器实际有效算力仅相当于6台,而超节点可将损耗压缩至5%以内。 其三,工程成熟度达到量产临界点。超节点是软硬协同的系统工程,涵盖芯片、互连、存储、散热、供电与系统软件。过去一年,国内厂商已完成从样机验证到产线爬坡的关键跨越。截至2025年中,华为、百度、浪潮、新华三、中科曙光等均已具备百套级交付能力,年底将实现全行业主流算力企业的标配化交付能力。

共识正在凝聚,分歧仍在演化

关于超节点的适用重心,业界尚未统一:华为与摩尔线程倾向训练与推理双场景覆盖;沐曦聚焦Decode阶段推理效率;清微智能观察到当前微调应用更多,但推理性能提升更显著。规模之争同样持续——“64卡足够论”强调TP/EP并行极限与工程稳定性,“千卡必需论”则指向Agent时代百万Token上下文与多智能体并发的新负载特征。 CUDA兼容性亦非非黑即白。平头哥、沐曦选择生态平移降低迁移成本;昇腾、昆仑芯坚持自研栈以保障长期可控性。一位资深架构师指出:“当Agentic coding成为主流,编程主体从人转向Agent,底层指令集的‘心智负担’权重正在下降,生态价值逻辑或将重构。” 真正形成的共识,是软硬协同不可逆。模型架构分化(如Linear Attention vs Smart Attention)正直接牵引硬件适配方向;而算力基础设施的演进逻辑,也正从单一摩尔定律驱动,转向算法—介质—网络—芯片的联合创新范式。正如浪潮董事长所言:“今天最有效的算力提升,来自一行新算法与一块新PCB板的同步诞生。”

下一程:从交付能力到Token成本竞争力

超节点竞赛已越过技术验证期,进入比拼批量交付稳定性、集群长期可用率与真实业务场景下的每Token成本的深水区。供应链韧性成为隐性门槛——芯片、高速连接器、液冷部件的国产替代进度,决定厂商交付节奏与客户信任周期。一位一线交付负责人坦言:“现在客户不问你有没有超节点,只问你能不能连续跑满30天、故障率低于0.1%、每千Token电费是否比上一代低15%。” 当算力越来越便宜,AI应用的渗透边界就不断外扩。从代码生成到工程设计,从会议纪要自动成文到政策仿真推演,知识生产正经历范式迁移。而超节点,正是这场迁移中最底层、最沉默、也最关键的算力基石。

(5)

夜夜笙
夜夜笙 2天前

国产超节点发展挺猛啊,三条路径并进,看来未来竞争会很激烈。

0
莽村大宏伟

感觉超节点挺厉害的,能大幅提升算力,但能不能在市场站稳还得看交付和成本。

0
Steven.
Steven. 2天前

模型规模倒逼硬件重构,超节点是顺应趋势,就看后续成本和稳定性咋保障了。

0
user13
user13 2天前

这超节点确实有搞头,能解决很多传统服务器的问题,不过不同技术路径和适用场景的分歧估计还得争一阵。

0
富在术数

超节点要是能解决交付和成本问题,AI应用肯定能扩展得更快,这是好事。

0

新西兰发放近海油气勘探许可

新西兰政府29日授予一家私营企业许可证,允许后者在塔拉纳基盆地近海区域展开12年期的石油勘探,为去年解除相关禁令以来首例。

也门胡塞武装拟对途经红海南部的商船征收通行费

市场消息:也门胡塞武装拟对途经红海南部的商船征收通行费。

花旗将迪士尼目标价从145美元下调至135美元。

花旗将迪士尼目标价从145美元下调至135美元。

花旗将Visa目标价从400美元上调至440美元。

花旗将Visa目标价从400美元上调至440美元。

花旗将康宁目标价从240美元下调至220美元。

花旗将康宁目标价从240美元下调至220美元。

国家网信办就《中华人民共和国反网络暴力法(征求意见稿)》公开征求意见

为了预防、制止和惩治网络暴力,加强反网络暴力工作,保护个人、组织的合法权益,维护国家安全和社会公共利益,按照有关立法规划计划安排,国家互联网信息办公室会同有关部门起草了《中华人民共和国反网络暴力法(征求意见稿)》,现向社会公开征求意见。

渤健公司股价在公布第二季度业绩后盘前下跌2.2%。

渤健公司股价在公布第二季度业绩后盘前下跌2.2%。

中国-东盟区域医药交易(集采)平台推动国产手术机器人在越南进入临床使用

国家医保局消息,近期,中国-东盟区域医药交易(集采)平台助力国产手术机器人完成越南产品注册并取得上市许可,在越南部分头部医疗机构完成安装并投入临床应用,实现了国产大型医用设备在越南从产品注册到临床应用的重要突破。同时,还将推动中越双方就机器人手术技术培训、临床应用推广、学术交流、人才培养等方面开展深度合作。

花旗将希捷科技目标价从1240美元上调至1300美元。

花旗将希捷科技目标价从1240美元上调至1300美元。

为了预防、制止和惩治网络暴力,加强反网络暴力工作,保护个人、组织的合法权益,维护国家安全和社会公共利益,按照有关立法规划计划安排,国家互联网信息办公室就《中华人民共和国反网络暴力法(征求意见稿)》公开征求意见。

为了预防、制止和惩治网络暴力,加强反网络暴力工作,保护个人、组织的合法权益,维护国家安全和社会公共利益,按照有关立法规划计划安排,国家互联网信息办公室就《中华人民共和国反网络暴力法(征求意见稿)》公开征求意见。