共赴昇腾 同耀光芒:昇腾AI开发者峰会2026在京圆满落幕  

2026年5月22日 鲲鹏昇腾开发者大会2026——昇腾AI开发者峰会2026于北京圆满举行。本次峰会以“共赴昇腾 同耀光芒”为主题,聚焦汇聚全球尖端技术,打造面向开发者的高端思想盛宴。昇腾坚持开源开放理念,持续为开发者提供高效易用的开发工具,全力构建繁荣的开发者生态,与每位开发者并肩共创未来。  

过去一年Agentic AI迅猛发展,华为在AI Infra层面已迈入超节点时代。华为公司Fellow、半导体首席科学家廖恒在《面向Agentic AI时代的昇腾超节点最佳实践》主题演讲中指出:针对预训练、推理Prefill与Decode等各类业务负载,AI芯片的算力、内存带宽、内存容量、互联IO带宽四大核心指标,在不同应用场景下优先级各不相同。尤其互联能力直接决定超节点性能。依托昇腾950芯片卓越的互联能力,可构建更高带宽、更低时延、覆盖更广的超节点。整体而言,系统综合性能等于超节点规模与单芯片性能规格的乘积。  

Agent时代下,MoE模型推理对时延提出更高要求,需压缩至10毫秒、5毫秒,甚至1毫秒级别。而EP的Dispatch-Combine通信正是制约时延的关键瓶颈。廖恒强调,EP通信应在Scale Up域内完成,因其属于All-to-All这类多对多的极细粒度通信,单数据包仅7KB至14KB,交互频次随专家数量呈平方级增长,传统网络架构难以承载,无法实现低时延传输。关于通信方式选择,廖恒认为应依据通信颗粒度:若通信量小,Load&Store内存语义更具优势;若颗粒较大,则建议采用DMA,同时尽量避免多个网络流量路径重叠。  

Agentic AI亦对KV Cache带来更大挑战一方面,模型调用频次激增50至100倍;另一方面,序列长度从Chatbot典型的4k提升至近1兆,增长达250倍。受此影响,KVCache命中率突破95%。高命中率显著降低Prefill成本,却也导致KVCache成本同比上升。对此,华为创新设计集成UB端口的SSU单元,直连UB网络。该架构精简存储系统、文件系统及文件系统名到SSD逻辑扇区的转换流程,消除原有路径多重障碍,使NPU可直接命中SSU的KVCache,SSU经由UB网络将数据传至NPU片上内存,带宽至少提升  

廖恒表示,昇腾始终贯彻“芯片架构-系统架构-集群架构-软件架构”的深度协同,持续迭代硬件能力、优化CANN等基础软件,兼顾生态兼容性与系统运行效率,为业界夯实算力根基。

  

华为公司Fellow、半导体首席科学家 廖恒  

聚焦易用性持续进阶,构筑从好用到易用的昇腾算力底座  

会上,华为昇腾计算产品部部长周斌发表《聚焦易用性持续进阶,构筑从好用到易用的昇腾算力底座》主题演讲,从开发者视角系统阐述昇腾软件易用性建设最新进展,围绕CANN全面开源开放、兼容主流开源生态、Mind系列软件升级并开源贡献三大方向,不断降低开发门槛、提升开发效率,为AI开发者提供全流程高效开发体验。  

华为昇腾计算产品部部长 周斌  

CANN作为昇腾软件底座与生态核心,已实现全面开源开放,为开发者提供完整、高效、开放的算子开发体系。目前已完成分层解耦与开源,开放运行时、算子编译等全层级接口,算子与通信库支持独立升级,已开源50余个源码仓。  

算子编程层面,昇腾针对不同开发者需求提供全栈支持:面向追求极致性能的工程师,提供Ascend C、CATLASS模板库,支持对计算、访存、流水等关键环节进行细粒度控制,充分释放芯片潜能面向注重快速创新的AI算法工程师,支持TileLang、Triton等主流Tile编程生态,并推出PyPTO,以Tensor抽象简化算法创新流程。为降低开发门槛,昇腾全面拥抱Python生态,推出PyAsc、Python版CATLASS模板库及PyPTO,使开发者能以Python友好方式实现底层并行与高性能算子开发。  

昇腾还打造了CANNBot算子智能体,将微架构优化经验融入skill技能库,支持Ascend C、CATLASS、Triton、TileLang、PyPTO等多种编程范式,覆盖算子开发全流程。基于CANNBot,单个Vector算子生成仅需3小时,从生成到部署全流程可在1天内完成,相较传统人工开发效率提升5倍以上。为进一步赋能业界Agent与大模型适配昇腾算子,昇腾还专门构建了专属算子数据集与评测集:算子数据集涵盖Vector、Cube、CV融合算子数据,通过高质量样本与专业思维链助力大模型理解算子写法;算子评测集提供分级评测体系,覆盖22类典型算子、内置4000+评测点,多维度评估算子生成的功能、精度与性能。  

在兼容主流开源技术生态方面,昇腾以全面兼容主流开源生态作为易用性改进核心方向,使开发者无需改变使用习惯即可高效调用昇腾硬件能力。算子编程层面,昇腾实现Triton和TileLang接口100%兼容,性能可达Ascend C的0.6~0.9倍,开发周期缩短至一周,已支持超600个Triton算子和300个TileLang算子,覆盖主流模型关键算子样例。  

北京大学计算机学院副研究员杨智表示,TileLang作为tile级编程框架,在DeepSeek V4的算子实践中展现出高开发效率与高性能,成功支撑昇腾全面适配DeepSeek V4推理,同时也验证了TileLang出色的跨平台能力,Developer模式下不同平台的算子仅有少量代码差异。未来TileLang for Ascend仍有广阔发展空间,如昇腾950的编程插件、torch.compile与Graph优化、超节点统一编程等。

  

北京大学计算机学院副研究员 杨智  

AI框架方面,昇腾全面支持PyTorch生态,实现2300多个API与社区对齐;图模式加速达成40+模型入图能力对齐,分布式加速实现20+主流大模型FSDP2开箱即用。训练加速领域,昇腾与8+强化学习社区建立合作,累计合入超万行代码。  

verl社区Maintainer侯正罡介绍,verl社区与昇腾深度协作,基于昇腾软硬件实现fully Async,并在基础架构上开展联合创新回馈社区,使强化学习训练效率提升2倍以上。  

verl社区Maintainer 侯正罡  

推理领域,昇腾全面适配LLM、多模态等核心场景,作为vLLM Project唯一自主创新硬件厂商、SGLang主仓唯一自主创新非GPU硬件厂商,原生合入主干代码并贡献关键特性,长序列场景首Token时延降低30%,xLLM框架也已原生支持昇腾。  

开源大模型推理引擎xLLM负责人刘童璇分享道,xLLM推理引擎如同操作系统般连接底层芯片与上层大模型应用,原生支持文本、图像、视频等全模态模型的推理加速,实现算力向模型智能高效转化。其架构深度契合昇腾超节点技术优势,推理性能卓越;同时开源大模型服务核心组件,构建从推理引擎到上层服务的完整技术栈。未来xLLM将持续紧跟技术趋势迭代架构,深度适配昇腾950超节点产品,立足Al for System理念,从技术跟随迈向标准引领,打造面向未来的智能超级大脑。

  

开源大模型推理引擎xLLM负责人 刘童璇  

在Mind系列软件全面升级方面,MindSpore面向超节点创新,推进组件化解耦,增强昇腾大模型图模式与分布式竞争力;MindSpeed通过架构革新,解耦插件,灵活适配开源社区使用,快速释放昇腾算力;MindIE系列软件栈全新升级,深度融合生态,助力推理更快、更稳、更简单;MindStudio开源开放并集成智能助手,全流程提升开发调试效率。  

全面升级昇腾开发者使能计划,共筑繁荣开源生态  

昇腾持续围绕开发者需求迭代升级,致力于为每位开发者提供更优的开发与学习体验。华为昇腾生态发展部部长张良在《汇聚开发生态,共建技术未来》演讲中,详述了全面升级后的昇腾开发者使能计划,涵盖社区体验、开发工具、激励权益三大方向。

华为昇腾生态发展部部长 张良  

面向社区,昇腾优化环境准备、部署、资料检索等流程,实现一键自动部署,平均2分钟即可跑通首个Demo。社区上线1000+昇腾卡,为每位开发者提供初始100卡时免费算力,基于一站式开发平台即取即用;算子开发易用性提升,算子工程升级、开源昇腾skills仓库,助力开发者高效开发调试;加强开源社区CI/CD建设及Committer专家投入,加速开源贡献的验证合入。  

面向开发工具,将数千名昇腾专家经验沉淀为skills,搭建Agent工作流,提供全新Agentic开发体验,开发者仅需描述需求即可完成各类模型开发操作,大幅缩短开发周期,使新手也能轻松应对复杂任务,加速创新想法落地。  

伴随基础软件全面开源,昇腾转向社区化运作,明确开发者成长与创新路径。设立首批创新激励基金,扶持算子、加速库等领域创新探索;投放10000卡算力资源,支撑开源社区研发运维与实操体验,充分保障开发者算力需求。  

昇腾始终心系开发者、聚力同行者。会上,华为ICT战略与业务发展部总裁彭红华、华为公司Fellow及半导体首席科学家廖恒、华为昇腾计算业务总裁张迪煊、华为北京总经理张东亚分别为杰出个人及团队颁发“昇腾开源贡献杰出个人奖”与“昇腾开源合作杰出团队奖”,以表彰过去一年昇腾开发者在技术创新与生态建设中的卓越贡献11名个人杰出贡献者获得“昇腾开源贡献杰出个人奖”荣誉,14个开源项目团队分别获得开源项目先锋团队奖、开源社区共建团队奖及AI4S 生态贡献团队奖。

昇腾开源贡献杰出个人奖

昇腾开源合作杰出团队奖

Agentic AI时代已全面开启,面向未来,昇腾将持续深耕超节点架构,提升易用性,打造好用易用的算力底座,壮大开发者生态。众行致远,聚力同行,昇腾诚邀广大开发者并肩前行,紧抓智能时代机遇,共同谱写Agentic AI时代高质量发展新篇章。

Logo

鲲鹏昇腾开发者社区是面向全社会开放的“联接全球计算开发者,聚合华为+生态”的社区,内容涵盖鲲鹏、昇腾资源,帮助开发者快速获取所需的知识、经验、软件、工具、算力,支撑开发者易学、好用、成功,成为核心开发者。

更多推荐