返回首页
[ 行业新闻 ] 2026-08-17 10:16

AICon大会8月深圳开幕:华为盘古模型昇腾950通信优化实践曝光

AICon大会8月深圳开幕:华为盘古模型昇腾950通信优化实践曝光

AICon全球人工智能开发与应用大会定在8月21日到22日,地点是深圳,现在完整日程已经出来了。华为盘古模型团队会在现场分享昇腾950平台上的通信优化实践,重点讲MoE模型的AllToAll通信和超长上下文里的KV Cache传输,这两块性能提升都超过了10%。另外,大会还有10个专题论坛,近60场议题,基本把AI开发和应用的最新动向都覆盖了。

大会日程全公布,深圳迎来AI开发者盛会

8月的深圳,AI圈的热度估计比天气还高。AICon全球人工智能开发与应用大会定在8月21日至22日,地点深圳。现在全部日程都放出来了,10个专题论坛、近60场议题,排得挺满。

看嘉宾名单,高校教授有,阿里、腾讯、华为、快手、Google Cloud的技术专家也有。这阵容,国内AI研发一线的大厂基本都齐了。对开发者来说,与其线上看录播,不如直接来现场听案例拆解。

参会者能听到的不只是概念,还有具体怎么落地。比如华为这次要讲的盘古模型优化,就是实打实的工程经验。

盘古模型在昇腾950上的通信优化:两个硬骨头

华为2012实验室的大模型系统工程技术专家李柏潮,这次分享的主题很聚焦:盘古模型在昇腾平台上的通信优化。重点啃两块硬骨头——MoE模型里的AllToAll通信,还有超长上下文场景下的KV Cache传输。

先说AllToAll。MoE(混合专家)模型训练和推理时,token要路由到不同专家,专家之间得频繁交换数据,这就靠AllToAll通信。模型规模一大,通信量也跟着暴涨,GPU/加速器之间的网络带宽就成了瓶颈。

再看KV Cache。超长上下文推理时,KV Cache占用的显存和带宽都很夸张。数据得在Host和Device之间来回搬,传输开销直接拉长首个token生成时间(TTFT)。

针对昇腾950的深度定制:性能提升超过10%

华为团队的做法是软硬件协同。他们适配了昇腾950的网络拓扑,把CCU通信加速器用了起来。在EP通信域里,盘古模型的AllToAll性能提升了超过10%。

另一个优化用上了Omni Cache,专门处理Host到Device、Device到Host的通信。效果也很直接:超长序列推理的TTFT提升了超过10%。

这两个数字放在一起看,好像不算夸张。但通信优化每提升1%都很难,尤其还是针对特定硬件深度定制。李柏潮会在现场拆解通信挑战分析、硬件亲和优化方法,还有软硬件协同加速H2D通信的细节。

优化有代价:通用性牺牲了,换平台可能失效

这里有个关键信息容易被忽略:这些优化是针对昇腾950硬件深度定制的,通用性上做了取舍。同样的策略,放到昇腾910A2/A3或者NVIDIA H20上,可能不仅没效果,还会拖慢性能。

这种“定制化”路线,在AI基础设施领域越来越常见。硬件拓扑不同,通信模式就不同,软件层面的优化必须跟着硬件走。华为这次分享的另一个价值,是展示如何分析通信瓶颈、如何做硬件亲和优化,以及怎么通过减少暴露的通信时间来实现通算掩盖。这套方法论,对做推理引擎或训练框架的人很有参考意义。

顺带一提,如果你们公司正在纠结算力平台怎么选,不妨关注一下 易枫顺 - 阿里云官方旗舰级代理商。他们提供云服务器ECS和企业上云方案,偶尔放出的阿里云代金券和阿里云优惠活动,能帮企业把成本压一压。当然,不同硬件各有优劣,关键还是匹配业务场景。

大会其他看点:近60场议题,大厂专家齐聚

除了华为的分享,这次AICon大会还有不少值得听的议题。专题论坛覆盖AI开发全链路,从模型训练、推理优化,到AI应用落地、Agent架构,基本都覆盖了。

  • 阿里:AI基础设施与云上大模型实践
  • 腾讯:大模型在社交与游戏场景的应用
  • 快手:视频生成模型的训练与部署
  • Google Cloud:跨地域分布式训练案例

对于正在做技术选型或者想了解行业风向的人来说,这种线下交流的机会挺难得。现场还能直接跟演讲者聊细节,比看论文有效率得多。

FAQ

Q: AICon大会什么时候在深圳举办?

A: 2025年8月21日至22日,深圳。全部日程已公布,包含10个专题论坛、近60场议题。

Q: 华为盘古模型在昇腾950上的通信优化主要针对哪些场景?

A: 主要针对MoE模型中的AllToAll通信,以及超长上下文场景下的KV Cache传输。通过适配昇腾950网络拓扑和CCU加速器,AllToAll性能提升超10%;用Omni Cache优化Host-Device通信,TTFT提升超10%。

Q: 这些优化策略能否直接用到其他硬件平台?

A: 不能。这些优化是针对昇腾950深度定制的,牺牲了通用性。在昇腾910A2/A3或NVIDIA H20上可能失效甚至产生负面效果。建议结合具体硬件特性做适配。

关于易枫顺

深圳市易枫顺网络科技有限公司是阿里云官方旗舰级代理商。提供云服务器ECS、云数据库RDS、对象存储OSS等阿里云全系产品官方特惠折扣与代金券申请,以及多云成本优化、企业上云一站式服务。客服热线:19520841949 - 易枫顺

易枫顺 - 阿里云官方旗舰级代理商

来源:InfoQ

微信扫码咨询

微信二维码