淬火赋能育“京”英,智启AI新未来丨昇腾“淬火行动”北京专场圆满举办

2026年7月22日-24日,昇腾“淬火行动”伙伴能力提升专项行动——北京专场圆满收官。三天课程围绕昇腾AI基础软硬件平台,从昇腾硬件到智能体应用、模型训推调优到商业落地实践展开系统化淬炼,全程理论授课搭配真机实操,互动实训贯穿始终,全方位夯实伙伴技术能力与项目交付硬实力。

图片1.png

本次活动汇聚互联网、智能制造、金融、医疗等众多领域行业伙伴,集结百余位AI算法工程师、技术骨干与相关开发者参与。培训内容覆盖“全系列硬件产品—高性能推理—分布式训练—智能体模型使能全流程”,全面提升开发者昇腾AI技术实践能力。实现从硬件选型、模型部署、性能优化到项目落地的完整技术闭环。

培训启幕,华为北京政企Marketing与解决方案销售部部长于督在培训致辞表示,当前AI产业人才结构失衡,行业亟需百万级AI工程化实操技术人才,支撑各行各业数字化、智能化转型落地。本次昇腾淬火行动,面向核心伙伴、ISV伙伴、OEM伙伴及广大开发者开展的系统化技术赋能,补齐团队在项目交付、AI应用适配层面的短板,打通客户业务需求—算力底座—AI应用落地之间的最后一公里,同时为广大昇腾开发者搭建起清晰高效的技术成长路径。他希望学员通过三天线下课程充分了解昇腾AI基础软硬件平台能力,并积极反馈课程及产品改进建议,一起共建繁荣昇腾生态。

图片2.png

紧随其后,昇腾生态专家韩祥永围绕昇腾AI基础软硬件平台展开。他指出,2026年Agent应用迎来规模落地元年,计算效率直接决定企业竞争力。昇腾芯片会一年一迭代,匹配性能和易用需求,目前昇腾NPU架构演进至矩阵+向量+线程+CCU的四维体系,同时联合硬件伙伴打造全系列训推硬件产品;软件层面,CANN全面开源并分层解耦;昇腾PyTorch已发布2.12.0版本、对接社区API 3200余个;MindSpeed和MIndIE快速演进,使能技术和模型创新;同时昇腾与vLLM、SGLang、verl等三方主流框架深度适配。生态方面,CANN持续开源开放,68个社区项目上线,月活开发者突破3500+,全面拥抱并贡献主流开源生态,联合90+三方社区优化使用体验。社区的代码下载量从开源初期的127万,跨过了千万级别,平均每天有6万多次下载。

昇腾AI技术专家刘爔炀围绕vLLM Ascend模型迁移、性能优化与大规模专家并行推理部署展开深度技术分享。以Gemma3-12B迁移为案例,讲解了模型分析、功能打通、量化适配到性能优化的完整流程,重点演示了算子融合与AclGraph图编译两项关键优化手段,并通过Profiling数据分析模型性能瓶颈方法,从下发问题、通信问题和计算问题三方面重点讲解了性能调优方式。同时阐释了MoE模型大规模专家并行原理及Prefill/Decode分离部署方案,并演示了多节点分布式推理集群搭建的流程。昇腾AI工具链专家刘鹏程与唐珂联袂带来《MindStudio性能调优系列工具介绍》专题分享。两位专家阐述了"快速排查+详细排查"的核心调优思路——快速排查先确认问题场景与优化目标,再排查近期软硬件变更,优先判断劣化是否由变更引起;详细排查遵循"先集群再单卡"顺序,围绕下发、通信、计算三类问题逐一定界。在此基础上,介绍了三种数据采集方式——PyTorch Profiler API支持集群统一采集、msprof命令行擅长单节点灵活采集、MSPTI API轻量采集关键指标;三种分析工具——msprof-analyze快速定界、MindStudio Insight可视化全面分析、MindStudio Agent智能体自动分析性能瓶颈。性能调优工具已全面开源,覆盖采集、分析到智能调优全链路。

图片3.png

次日,昇腾AI技术专家张君以《AscendCL离线模型推理》为题展开专题授课。讲解了从在线推理打通、ONNX导出、OM模型转换到离线推理的全流程,以及Ascend IR中间表示、模型解释器及图优化编译机制。同时介绍了Device、Context、Stream三级资源抽象与运行时管理接口,以及AIPP预处理与DVPP硬件加速在图像处理中的应用,动态Batch、动态分辨率等推理方案。

昇腾 AI 技术专家刘太霜围绕从稠密到MoE的架构演进切入讲解大模型分布式训练加速套件MindSpeed,讲解PP/VPP、TP+SP、分布式优化器、专家并行、通信优化等一系列优化加速手段。同时介绍MindSpeed-LLM基于FSDP2后端的大模型训练适配流程,相比传统方式代码修改量减少90%、省去了权重转换步骤以及屏蔽了分布式通信细节,大大提升了易用性。

图片7.png

收官之日,聚焦前沿智能体技术与商业落地实践。昇腾 AI 技术专家顾梦沁深度讲解 Model Agent Skills平台,包括模型搜索、验证、适配、量化、调优、部署、文档优化七大智能体,协同 workflow 编排,配套 msModeling 仿真、自动化部署工具实操,依托Skills评估体系保障全流程稳定。现场结合 Qwen、Gemma、多模态模型案例演示,自动化完成全流程适配,大幅缩减模型落地周期,带领学员上手多终端实操调试。

xLLM 架构师张民超详解分布式推理引擎 xLLM,拆解 Hybrid EPD 分离、多级 KV Cache、PROSERVE 多优先级调度、图执行等核心优化特性,给业界带来全新的推理体验。昇腾技术专家王恒泽则立足实际商业项目,结合参训开发者的日常工作场景与任务需求,系统讲解不同业务场景下的参数配置、性能表现,以及各类部署方案对应的配置方法与优化技巧;重点围绕大模型场景的硬件部署方案、大 EP 集群推理方案的整体架构及调度策略的软件设计展开分享。

图片9.png

图片11.png

优秀开发者牟笛现场分享了从 Ascend C、Triton 基础概念学习,到独立完成算子开发、承接社区任务的完整实践经验,重点讲解了 CANNBot 自动化开发链路与赛事中的算子调优方法,并将自身经验梳理为五大要点,为在场开发者总结出一套从零到一的成长路径。

最后,华为昇腾生态创新中心总经理赵满意为实操考核中表现突出的学员颁发优秀学员证书,并表示后续会依托北京淬火行动开发者平台,常态化开展开发者技术分享、模型调试实操、Meetup等生态活动,持续为本地生态伙伴及开发者提供及时有效的技术支撑。

图片14.png

图片16.png

未来,昇腾“淬火行动”将持续立足北京、辐射全国,携手更多伙伴和开发者,以开源开放的昇腾AI基础软硬件平台为基石,加速AI与实体经济深度融合,共同绘就昇腾AI生态繁荣与智能产业高质量发展的宏伟蓝图。


本文来源于DOIT传媒,文章内容仅供参考,不构成投资建议。

赞 ()

相关推荐

发表回复

评论列表

点击查看更多

    联系我们

    微信:百易小助手

    邮件:contact@doit.com.cn

    工作时间:周一至周五,9:30-18:30,节假日休息

    微信