HUAWEI CONNECT 2026:48000颗光模块被5500个光引擎换掉,算力竞赛悄悄换了赛道

图片

全网还在盯着单卡参数来回拉扯,HUAWEI CONNECT 2026直接把赛道升级。9月17日在上海开幕的这场大会,抛出的核心信号很直白,AI算力比拼早已告别简单堆卡,真正的胜负手藏在系统互联架构里

需求侧正在发生阶跃式升级。大模型参数迈向十万亿、百万亿级,智能体的连续执行时间从小时级走向月级,token日消耗量迈向百万亿级,中国每日推理token已经涨到约500万亿的量级。传统服务器加交换机的堆叠模式,在万卡以上规模会接连撞上通信墙、功耗墙与可靠性墙,超节点架构正是为破解这三重瓶颈而生

 

很多人看算力新闻,习惯只盯芯片纸面参数。单卡跑分好看,不代表集群跑大模型就顺畅。大规模集群里,卡与卡之间的数据传输才是隐形瓶颈。卡再多,数据来回等待,大量算力会空转浪费,就像高速路网修了无数车道,互通匝道狭窄,车流依旧堵死。

汪涛在会上披露,传统服务器架构下集群内通信可超过训练时间的40%,MFU被严重拖累。

差距有多大,仿真给出了量化答案。同样是10万卡规模,华为马尔可夫实验室的仿真显示,由4K超节点构成的集群,相比传统8卡服务器构成的集群,MFU提升2.75倍。换句话说,芯片数量不变,有效产出接近三倍,这就是超节点架构能够取代传统堆卡模式的底层逻辑。

图片

昇腾960超节点就是冲着这个堵点来的。它把NPO近封装光学技术第一次带到量产级别,用Hi-ONE光互联组件重构集群内部的数据流通方式。五千五百个Hi-ONE替代原本需要的四万八千颗800G光模块,功耗直接砍掉超550千瓦,系统无故障运行时长翻倍,可用度做到99.8%。依托灵衢统一互联实现内存统一编址,单超节点做到4096卡规模,原生适配十万亿参数级别的大模型的训练与推理。

Hi-ONE本身也是产业坐标。它是业界首个量产的NPO光引擎,单引擎传输容量7.2T,也是目前唯一内置光源的近封装光学产品。它把光互联从可插拔板卡形态推进到贴近封装的位置,缩短了电信号传输距离,同时大幅减少端口数量与布线复杂度,是互联技术从板级走向封装级的关键一步。

图片

芯片节奏同样超出预期。昇腾960研发进度提前,性能实现倍增,960DT比原定计划早三个季度就绪,960PR提前一个季度,后续970与980已经排进2028与2029年,一年一代的迭代节奏被再次确认。国产算力的迭代曲线,第一次有了可以锚定的确定性。

图片

 

一个容易被忽略的拐点正在出现。过去两年行业重心集中在训练,而推理侧的需求增速已经反超。大量企业不再执着于训练巨型基础模型,而是持续部署智能体,持续生成token。超节点架构恰好适配这种变化,它不追求一次性跑出峰值,而是保证长时间稳定输出,满足智能体持续交互和行业模型常态化调用的需求。

大会同步推出的OceanStor M900 AI记忆存储,补的正是算力之外的短板。智能体时代的AI不再是算完即弃的单次任务,它需要记忆,需要持续调取历史信息,存储不再是附属配件,而是算力体系不可分割的一环。M900基于灵衢统一互联支持一跳直连,定位PB级KV缓存集群,配套的Retention算法可把SSD读写寿命提升16倍。

图片

至此,整套体系已经形成计算、互联、存储的三位一体。昇腾超节点负责AI计算,鲲鹏超节点负责通用计算,OceanStor M900负责AI记忆与KV缓存,三者经由灵衢统一协议平等互联,大幅减少协议转换开销,实现算力、存储与网络的协同调度,集群规模最大可支撑百万卡级别。

生态层面的变化同样值得记录。昇腾体系已进入PyTorch官方支持的技术路线,CANN社区月活跃开发者突破5200名,基于昇腾加CANN的原生训练模型超过40个,是国内目前唯一支持预训练的技术路线。鲲鹏全球开发者超过416万,openEuler装机量超过2000万套,拿下中国服务器操作系统份额第一。硬件性能再强,如果上层生态单薄,最终只能停在实验室样机,沉不到行业生产线。

 

算力底座的边界也不止于数据中心。华为计划围绕AI Phone、AI PC、车与家庭场景构建四大端侧算力平台,通过端端算力协同与端云算力协同,构筑分布式群体智能。网络侧则围绕用算构筑新一代通信网络,把智能从中心机房延伸到边缘与终端。

行业里有一种误区,觉得算力就是芯片的单打独斗。HC2026给出的答案恰恰相反,AI基础设施是算存传一体的系统工程单卡只是零件,超节点才是可规模化部署的基础单元,再由超节点拼接成百万卡级别的巨型集群。未来的算力竞争,拼的是整套系统的吞吐、稳定性、互联效率与生态落地能力。

硅基黑土地可以拆成四层来看。

底层是昇腾芯片与超节点硬件底座,中层是鲲鹏、openEuler、CANN组成的基础软件生态,上层是大模型与智能体的应用生态,顶层是面向千行百业的规模化赋能。

这套体系的核心目标,是把AI落地的技术门槛与成本门槛持续压低,让智能化能力成为各行业可以直接取用的基础资源。目前昇腾910C超节点已部署超1000套,950超节点进入规模商用,商业化的地基已经打好。

算力赛道的下半场,比的不再是谁拥有更多芯片,而是谁能搭建稳定高效、可以持续生长的完整基础设施。HC2026释放的信号很清楚,国产算力已经跨过从零到一的基础建设阶段,正式进入规模化落地的全新周期。


- END -

本文来源于DOIT传媒,文章内容仅供参考,不构成投资建议。

赞 ()

相关推荐

发表回复

评论列表

点击查看更多

    联系我们

    微信:百易小助手

    邮件:contact@doit.com.cn

    工作时间:周一至周五,9:30-18:30,节假日休息

    微信