算力「芯」动向 | 国产算力超节点集体亮剑:WAIC 2026揭示的算力竞争新维度

🐆:WAIC 2026超节点密集亮相,华为、摩尔线程、壁仞等厂商集体亮剑。万亿参数时代倒逼算力从单卡竞争转向系统级重构,光互连与液冷突破工程瓶颈,“Token工厂”标志推理需求反超训练,国产算力正以体系化突围弥补单芯片代际差距。

WAIC 2026 · 深度观察


超节点密集亮相WAIC 2026
国产算力正从“单卡突围”走向“系统级重构”

万亿参数大模型与智能体应用的爆发,正在倒逼算力基础设施发生一场结构性变革


2026世界人工智能大会期间,超节点成为最密集的技术关键词,华为昇腾、阿里云、摩尔线程、壁仞科技、燧原科技、沐曦股份、阡视科技、超聚变、曙光、清微智能、新华三、中兴等厂商集体亮剑,国产算力竞争正从单芯片性能比拼,加速向系统级互联与生态整合能力延伸。


从“单卡算力”到“系统算力”
超节点为何成为刚需

大模型参数规模从千亿迈向万亿级别,上下文窗口从256K扩展至百万级,Agent应用要求模型持续自主运算并反复读写KV Cache。

这些趋势使得单卡算力已无法独立承载复杂任务,海量GPU高效协同成为底层刚需。

壁仞科技AI框架架构副总裁丁云帆指出,当前AI发展面临超大参数、超长文本、超大集群三大核心挑战,仅凭单张GPU的算力性能已难以应对,超节点架构正是着力破解这一难题的系统级方案。

超节点的本质是将数十、数百乃至上千颗AI芯片通过高速互联技术整合为统一的计算系统,使众多芯片如同一台超级GPU般协同运作。


  • 华为昇腾950超节点实现1024卡Scale-up扩展,提供1 EFLOPS FP8算力与256TB全局统一内存编址空间;

  • 摩尔线程MTT C256突破业界普遍的一层网络64卡限制,首次在一层Scale-up网络中实现256卡全互联;

  • 壁仞科技推出下一代NPO光互连、分布式解耦架构超节点方案,支持1024卡扩展并采用Chiplet架构BR2xx系列芯片。

这些方案的共同指向是算力竞争的核心指标已从单卡TFLOPS转向系统级互联带宽、内存一致性与集群扩展效率

光互连与液冷
超节点落地的两大工程瓶颈

超节点方案密集发布的背后是电互连正面临规模扩展的物理极限。

传统多层网络带来的带宽损耗与高延迟痛点,迫使行业向光互连迁移。


壁仞科技选择NPO(近封装光学)作为下一代超节点核心方案,通过GPU节点与交换机节点物理分离部署、光纤灵活互连,彻底告别传统定制高密整机柜的大铁盒子形态。

这一技术路线若能在工程层面实现稳定量产,将显著降低超节点的部署成本与运维复杂度。

散热则是另一项关键挑战。


  • 超聚变展示的单柜128卡方案采用第五代100%原生液冷整机柜技术,PUE低至1.06

  • 曙光8000十万卡集群搭载浸没式相变液冷方案,可承载单机柜兆瓦级高功率部署。


液冷技术从可选方案变为超节点标配,意味着算力基础设施的能耗管理正进入新维度,绿色算力不再只是政策导向,而是成为技术可行性的硬约束。

“Token工厂”概念兴起
推理需求反超训练

一个值得关注的产业信号是超节点的应用场景重心正在从训练向推理偏移。

壁仞科技判断虽然训练侧单次投入巨大,但能够训练顶尖大模型的公司正在减少。

相反,随着多模态和Agent兴起,推理侧整体算力需求规模已超越训练,且对延迟要求极高,对超节点域大小的要求甚至比训练更苛刻。

阡视科技直接将其超节点系统命名为“Token工厂”,搭配自研HitenOS大模型专用操作系统,针对批量AI文本生成场景实现软硬件深度适配,综合性能最高可提升10倍以上。超聚变展出的TokenBox平台同样将超节点能力从数据中心延伸至企业业务现场。


这种Token工厂概念的兴起,标志着算力供给逻辑正在从支撑模型训练转向服务智能体推理的工业化生产。

国产算力的“系统级突围”

若仅看单颗芯片,国产GPU受制于制程工艺,与国外顶尖水平仍存在代际差距。

但在超节点层面,国产厂商正通过系统级创新弥补单芯片短板。

曙光8000实现“芯片、计算、存储、网络、散热、应用、服务”全链路自研国产化,以海光芯片为底座完成十万卡规模组网,并接入国家超算互联网;阡视科技wylon系统已完成与寒武纪、壁仞、沐曦、海光、摩尔线程等主流国产芯片的联合开发,构建从芯片到应用的完整生态。

这种不是单点突破,而是体系化突围的策略,正在形成国产算力的差异化竞争路径。


中银证券指出,国产算力竞争正进一步向芯片互联和系统集成能力延伸。国泰君安、海通证券则认为,本届大会最值得关注的是国产AI产业链能否从底层算力、芯片系统,到大模型、Agent OS、智能终端,再到具身智能与行业应用,形成完整交付能力,推动行业从单点突破走向系统化产业兑现

超节点在WAIC 2026的密集登场,并非简单的技术参数竞赛,而是国产算力应对万亿参数时代与智能体推理刚需的系统性回应。当单卡制程红利见顶,互联带宽、内存一致性、软件生态与散热工程成为新的竞争维度。这场“群雄逐鹿”的深层逻辑在于国产算力正在证明,系统级整合能力可以部分替代单芯片性能优势,而超节点正是这一战略转向的核心载体。未来一年,随着更多超节点产品走向客户交付与规模化落地,国产算力的系统级能力将面临真正的市场验证。


算力“芯”动向 · 专注AI与算力产业观察

今日阅读文章分享:

(1)直击WAIC 2026:大模型迈入万亿参数时代,国产AI超节点上演“群雄逐鹿”

(链接:https://www.cls.cn/detail/2430567)

(2)WAIC 2026“超节点”密集登场 国产AI基础设施迈向系统级竞争时代

(链接:https://www.stcn.com/article/detail/4027929.html)

(3)把 256 张 GPU 变成一台计算机:摩尔线程 MTT C256 超节点亮相 WAIC 2026

(链接:https://www.ithome.com/0/978/856.htm)

(4)华为、阿里等集体亮剑 超节点多成果亮相WAIC 国产算力向互联和系统集成延伸

(链接:https://www.cls.cn/detail/2430308)

(5)WAIC超节点产品火热背后:智能体引爆“推理刚需” 国产算力体系化突围

(链接:https://finance.eastmoney.com/a/202607183811469789.html)

(6)WAIC 2026:阡视科技发布专为Token工厂而生的超节点系统

(链接:https://www.jfdaily.com/staticsg/res/html/web/newsDetail.html?id=1146951)

本文若有歧义欢迎读者分享指正。


·END·



扫描下方二维码 关注我们


我们以算力为线,持续跟进算力基础设施的报道,输出洞察,伴随算力行业实现算力自由。敬请关注!

本文来源于DOIT传媒,文章内容仅供参考,不构成投资建议。

赞 ()

相关推荐

发表回复

评论列表

点击查看更多

    联系我们

    微信:百易小助手

    邮件:contact@doit.com.cn

    工作时间:周一至周五,9:30-18:30,节假日休息

    微信