AI时代CPU何为系列文章-Agentic AI时代浪潮信息持续迭代CPU原生液冷整机柜

Agent规模化落地的本质是系统工程规模化,CPU不再是GPU的附属配套,而是海量智能体调度、沙箱隔离、流程执行的核心底座。

7月9日,2026开放计算技术大会在北京举办,浪潮信息副总经理赵帅带来《打造领先的Agent基础设施,加速产业AI转型》主题演讲。当行业长期聚焦GPU卡数、显存与推理速度时,他抛出核心判断:Agent规模化落地的本质是系统工程规模化,CPU不再是GPU的附属配套,而是海量智能体调度、沙箱隔离、流程执行的核心底座,只有高密度、全液冷、开放化的CPU算力集群,才能承载数万智能体7×24小时并发运行,完成任务拆解、工具调用、多轮自省等复杂逻辑工作。

一、负载范式反转:CPU承接Agent全链路逻辑调度

赵帅首先厘清对话式Chatbot与Agent智能体的本质算力差异,点明CPU价值回归的底层动因。传统问答AI仅完成一问一答,全部矩阵运算交由GPU完成,CPU仅承担简单请求转发;但Agent具备自主拆解复杂需求、串联多步骤任务、长期持续运行的能力,每一个独立智能体都运行在专属CPU沙箱内,大量流程调度、权限管控、记忆维护、工具交互、结果汇总等分支密集型逻辑运算,天然适配CPU通用算力,GPU仅负责最终Token生成推理。

产业数据印证CPU需求爆发:IDC预测2025-2028年AI Agent年复合增长率超110%;Gartner判断2026年40%企业应用将集成AI智能体,制造业、研发、办公场景已经落地规模化案例。生产场景中,氧化铝生产Agent依托CPU调度优化流程,生产效率提升60%、能耗下降3.6%;AI Coding Agent依靠CPU完成需求拆解、代码测试、文档生成全流程,研发周期压缩70%以上。海量智能体同步在线,对CPU算力密度、隔离能力、持续稳定运行能力提出刚性需求,传统低密风冷CPU服务器完全无法匹配。

赵帅强调,Agent基础设施存在两套不可分割的算力分工:GPU超节点是“思考引擎”,负责批量产出高质量Token;CPU整机柜是“行动中枢”,统筹所有智能体群体协同、状态管理与安全隔离,二者缺一不可,形成完整群智协同体系。

二、高密度算力瓶颈:原生液冷重构CPU整机柜架构

单机柜功率快速向兆瓦级迈进,成为制约CPU规模化部署的核心障碍。赵帅指出,传统风冷单机柜散热上限仅40-50千瓦,2026年底高密度AI机柜功率将突破300千瓦,中长期全面迈入兆瓦级算力时代,风冷散热彻底触及物理极限,原生液冷成为CPU集群的必选路线。

基于开放计算理念,浪潮开源液冷OCM标准化模组,打造业界面向Agent场景的CPU原生液冷整机柜,从三大维度重构CPU算力形态,解决高密度并发痛点。

第一,多元算力标准化模组,实现多形态Agent主机快速衍生。原生液冷重构内存模组,采用多阶导热架构,兼顾长上下文高内存带宽、高主频稳定输出两类Agent差异化需求,X86、ARM架构CPU可在同一底座无缝兼容,单柜最高部署384颗处理器,稳定支撑4万+智能体并发运行。

第二,超薄高密算力节点,大幅提升机柜算力密度。创新0.5U超薄算力单元,2U空间可容纳16颗CPU,整机内部无线缆设计,简化布线结构,整机柜运维效率提升150%以上,适配兆瓦级机房高密度部署需求。

第三,全部件全域液冷覆盖,保障7×24小时零中断运行。打破传统仅CPU冷板散热局限,针对SD网卡、光模块等可热插拔外设采用接触式导热方案,将所有高发热元器件纳入液冷体系,解决海量Agent长时间运行带来的持续散热压力。

这套整机柜专门适配Agent“有状态主智能体+无状态子智能体”混合负载,通过硬件层资源隔离,避免瞬时子Agent抢占缓存、TLB资源造成调度卡顿,同时匹配Agent宏观、微观双重闲置特性,支撑CPU侧资源超卖调度。

三、CPU-GPU协同闭环:双底座打通多模融合全链路

单一CPU算力无法独立完成智能体完整任务,CPU整机柜与元脑SD200多模融合超节点形成互补闭环,构建一体化Agent基础设施。赵帅现场披露多模型融合核心价值:AI系统竞争已从单一模型精度比拼,转向多模型并行推理、结果协同优化的系统能力。

SD200作为GPU侧Token生产底座,依托3D Mesh低时延互连架构,单机提供4TB统一显存,可同时驻留4个万亿参数大模型,支持多候选模型并行推理、评审融合。经过软硬件协同优化,万亿参数模型单Token生成时延从初代8.9毫秒压缩至4.77毫秒,国内首个突破5毫秒大关。实测基准数据显示,多模型融合方案在AIME2026数学推理、GPQA Diamond高难问答分别取得97.2%、90.8%准确率,大幅超越单一模型,完美匹配Agent复杂逻辑、专业问答、代码生成需求。

针对中小企业私有化部署需求,浪潮推出SD200企业版,依托16卡Scale-up统一计算域,万亿参数模型TTFT提升40%以上,降低企业落地门槛。CPU整机柜负责海量Agent并发调度、工具调用、上下文管理,SD200超节点承接高频推理请求,二者通过高速互连打通数据通路,形成“CPU统筹调度、GPU批量推理”的标准协同架构。

同时赵帅提出开放生态路线,整套软硬件架构基于OCM、OAM开放模组设计,完成国内主流开源大模型全适配,依托标准化硬件降低企业Agent应用迁移、开发适配成本,推动智能体快速落地千行百业。

结语

赵帅的分享清晰回答了“Agent时代CPU何为”这一核心命题:CPU不再是算力体系的边缘配角,而是承载海量智能体运行、统筹多模型协同、保障任务闭环执行的中枢核心。面对兆瓦级AIDC发展趋势,浪潮通过开源液冷OCM标准、原生液冷高密CPU整机柜、多模融合超节点双底座方案,补齐Agent规模化落地的通用算力短板。

未来AI基础设施的竞争,不再局限于GPU单卡峰值算力,而是CPU与GPU、散热、供电、网络全链路协同的系统能力。高密度、开放化、全域液冷的CPU整机柜,将成为支撑群智协同、推动Agent产业规模化爆发的核心基础设施。

本文来源于DOIT传媒,文章内容仅供参考,不构成投资建议。

赞 ()

相关推荐

发表回复

评论列表

点击查看更多

    联系我们

    微信:百易小助手

    邮件:contact@doit.com.cn

    工作时间:周一至周五,9:30-18:30,节假日休息

    微信