依托鲲鹏处理器矩阵算力 中科大陈俊仕团队破解稀疏计算效率难题
从电路模拟的复杂推演到量子化学的微观分析,大规模稀疏线性方程组的高效求解是科学计算领域的核心需求。但传统稀疏直接求解器因数据非零元分布稀疏且不规则,导致运算低效、算力浪费等问题。近日,中国科学技术大学计算机科学与技术学院特任副研究员陈俊仕团队,在鲲鹏昇腾科教创新卓越中心的算力支持下,创新研发出面向鲲鹏处理器矩阵算力基于密集kernel的LU直接求解器,以密集运算方式实现了稀疏计算的高效求解,成功突破传统运算瓶颈。
![[MD:Title]](/d/file/p/2025/12-01/0bba229d45d53ad57ba2d2aab21a1073.jpg)
该研究创新构建了一种面向稀疏矩阵计算的密集计算范式,系统化解构了传统稀疏直接求解器的性能瓶颈。团队通过将分散的非零元整合为更加规整的密集数据块,将不规则稀疏矩阵映射为统一稠密的大块结构,进而采用基于稠密矩阵运算的数值分解算法,取代传统稀疏运算中聚合非零小分块的碎片化计算模式,显著降低了由不规则内存访问引发的计算与调度开销,最终实现了计算效率与硬件利用率的协同优化。
该方案的顺利落地,深度依赖于鲲鹏平台的计算特性。硬件层面,鲲鹏920新型号集成专用矩阵运算单元,原生具备高密度数值分解运算的高效承载能力,可精准匹配密集数据块的集中化处理需求;其多核架构为大规模密集数据块的并行运算提供了坚实基础,避免算力闲置或过载。软件层面,鲲鹏 KML 数学库针对密集型矩阵运算进行深度优化,通过底层算法与硬件架构的协同,进一步放大了密集运算模式的性能潜力。经 70 余个跨领域测试集验证,该方案性能较SuperLU 求解器平均加速32.2倍,在基础硬件配置下实现了平均 9.6 倍性能加速,大幅压缩了科学计算的时间成本。
目前,相关研究成果已发表于 CCF B 类国际会议 Euro-Par 2025,其核心技术已申请中国发明专利并获得授权。此次成果是鲲鹏平台在科学计算领域的典型实践,该方法对于现代高性能处理器上稀疏计算问题的高效求解、充分地发挥处理器上的矩阵运算单元具有很好的应用价值。未来,随着鲲鹏生态的持续完善,其在高性能计算领域的赋能作用将进一步凸显,助力更多科研团队突破技术难关,推动科研成果加速落地转化。
《依托鲲鹏处理器矩阵算力 中科大陈俊仕团队破解稀疏计算效率难题》转载自互联网,如有侵权,联系我们删除,QQ:369-8522。
相关图文
-
Intel华丽回归!2026年开年股价已上涨31%
快科技1月19日新消息,曾经深陷低谷、被认为错过AI初期浪潮的半导体巨头Intel,不仅在2025年实现了股价的三位数增长,更在2026年初继续保持强劲势头。回望过去一年,2025年初Intel股价一度跌至... -
5名骑手用钢管将手指砸骨折 骗保超32万涉嫌诈骗被判刑
1月19日消息,据检察日报正义网报道,近期,一起由外卖骑手精心策划的保险诈骗案在成都宣判,骑手张某曾因送餐受伤获赔后,组织团伙骗保,通过故意将手指砸至骨折,累计作案8起,骗取3家保险公司... -
北方冬天的奇幻一幕!40℃温差让牛棚秒变凌霄宝殿
快科技1月19日消息,随着四九开场,一场寒潮来袭北方,大部分地区经历冷暖逆转。近日,一位网友分享了北方冬天的奇幻一幕,引发网友热议。在内蒙古锡林郭勒,40℃温差让牛棚秒变“凌霄... -
西贝回应羊肉1年集中采购1次:8-10月份是羔羊风味巅峰
快科技1月19日消息,最近西贝因为创始人贾国龙的接连发声重获关注,在冷冻西兰花等问题之外,还首次正面回应了羊肉1年集中采购1次的话题。西贝表示,这并非出于成本考量,而是尊重草原的自然规... -
分屏交互 决策更高效!蜻蜓点金深度适配鸿蒙折叠电脑 移动端体验焕新 专业投资如影随行
金融市场瞬息万变,对于投资者而言,他们对“专业”工具的需求,从来不局限于“功能”本身,而是希望在任何时间、场景下,都能以最便捷的方式实时获取行情动态、准确做出投...

















