聚焦大模型训练效率提升 北大依托昇腾突破细粒度混合并行技术

2025-08-01 15:24:47     来源:

在人工智能大模型迅猛发展的当下,大模型参数和计算量呈指数级增长,大规模深度学习模型的训练离不开多硬件设备的分布式计算。在鲲鹏昇腾科教创新卓越中心的算力支持下,北京大学计算机学院崔斌教授团队创新研发了面向大模型的高效分布式训练框架,大幅提升了大规模分布式训练模型的效率。

针对模型训练任务的多样性和复杂性所带来的负载不均问题,研究团队创新设计出了细粒度模型切分与并行策略搜索算法。此方法依托昇腾强大的计算资源管理能力,及算子优化技术对训练策略的适配,完成了统一训练接口到智能切分策略的全过程。首先通过总结多种大模型训练的共同特点,设计出统一的接口来启动和管理不同任务负载的模型训练任务,对训练时所花费的算力、内存、网络通信等进行精确地计算。接着基于这些数据细致拆解庞大且复杂的大模型,根据不同模块分配不同的训练策略以适应各模块的负载差异,实现训练任务的高效并行。目前,该方案已实现比分片数据并行、3D 并行等全局模版化并行方案提升15% 的训练效率。

除此之外,团队还解决了分布式计算所涉及的硬件间通信传输效率问题。结合昇腾高速互联总线技术的高带宽低时延优势,系统会很根据不同的通信需求,对硬件设备进行分组以优化组队时间,运用计算通信重叠技术让“计算”和“通信”同步进行,提高训练流水线的效率,并在模型切分的决策时考虑计算通信重叠的性能影响,综合多方面因素选取最适合的分布式运行方案,最终实现数据传输效率和资源利用率的最大化。

该研究成果不仅为模型大规模训练提供了高效的解决方案,更展现了自主算力在分布式计算领域的巨大潜力。目前,研究成果已在国际顶级学术会议NeurIPS、ICLR、AAAI发表3篇论文,为国内AI技术突破提供了理论支撑与实践范式。

北京大学 鲲鹏昇腾科教创新卓越中心的这一突破彰显了校企协同创新的显著成效。未来,中心将持续加速AI前沿技术在自主计算平台的深度落地,为我国人工智能产业的自主化突破提供强劲动能。

 

标签:

猜你喜欢

共筑流感防线 上海嘉会国际医院开启2025流感疫苗接种服务
礼来重磅研究发布,替尔泊肽迈向“心血管多维获益”新时代:中国同步参与彰显本地化创新提速
京东携手漫步者电竞、花再、韶音等国潮大牌新品耳机亮相ChinaJoy
年轻人的读书搭子:AI能力拉满,华为阅读把读书带上Next Level
Figma上市后的本土化机遇:AI时代MasterGo的战略价值凸显
打工人的“情绪续命”,全靠手腕上这个华为表盘
比免费奶茶更续命!华为这4款神仙主题,一秒“吹”走我的班味
核电大单,再下一城!亚信科技助力特大能源央企建设核电5G专网
破局与坚守:富森美用数字化基建与战略定力双轮驱动增长
数智赋能光储电站高质量发展,2025华为中国数字能源智能光伏运维大会成功举办
以“鲜”为美,“质”领未来,新希望乳业荣获2025年度ESG竞争力企业
中欧游戏企业在沪对话,完美世界分享“东西互鉴”合作新方向
上半年中国游戏收入大涨14% 完美世界:技术产业创新双螺旋引拉升
共铸高质量 智赢高价值 | 2025华为中国数字能源创新峰会·内蒙古成功举办
合规优先,风控为本:汇璟量化策略平台监管与资金安全体系
青葫芦荣登“中国儿童图书销量第一”:从“笨功夫 到“真王者”的背后
京东服饰携MQDmini、精典泰迪、木木屋等童装品牌开启工厂溯源 助力商家销售增长
「反正摔不坏 」西安站完美收官,G-SHOCK水墨限定款引爆街潮!
未拉上的工具包拉链
数字赋能银发生活 百度APP联合百战直播举办“得趣大湾区杯广场舞大赛”
来鸿蒙5应用市场AppGallery,跟专业营养师学生活化控糖!
市场地位声明:青葫芦 中国儿童图书销量第一
海伦钢琴“引智”转型:全拓卓戴5.48亿元入主
连续16年!快乐蜂(中国)蝉联中国餐饮企业TOP100 食安赋能品牌可持续
深圳建工:精品建造,精益管控,走出高品质发展之路
麻爪爪鸡爪卤味荣获尚普咨询集团系列市场地位声明
【独家专访】汇璟量化创始人
贯标3.0 | 两化融合管理体系3.0标准海外首次评定审核 福耀玻璃彰显行业领军风范
别让“情绪中暑”掏空你,打工人的手腕上藏着一个“降温”开关
比免费奶茶更续命!华为这4款神仙主题,一秒“吹”走我的班味