联想黄山:「超智融合」成算力新趋势,联想打造异构智算平台

2025-07-11 08:10:33 - 新闻

9 月 24 日至 26 日,联想力新联想第20届CCF全国高性能计算学术年会(CCF HPC China 2024)在武汉市中国光谷科技会展中心正式开幕。黄山

本次大会上,超智成算重庆高中内幕推荐联想以“异构智算 稳定高效”为主题,融合携“一横五纵”算力基础设施战略、趋势联想万全异构智算平台、打造联想AI解决方案、异构联想科学计算整体解决方案参展。智算

面对机器智能的平台浪潮,作为全球领先的联想力新联想科学计算解决方案提供商,联想以“一横五纵”战略框架,黄山构建布局完整、超智成算稳定高效的融合AI基础设施,为企业智能化转型打造坚实可靠的趋势智算底座。

在 24 日下午的打造重庆高中内幕推荐大会论坛上,联想中国基础设施业务群战略运营总监黄山发表了主题为“筑基新质算力 纵横数字未来”的精彩演讲。

联想黄山:「超智融合」成算力新趋势,联想打造异构智算平台联想中国基础设施业务群战略运营总监 黄山

演讲过程中,黄山主要围绕当前国产算力的瓶颈和破局之道展开分享。在他看来,“超智融合”已然成为 HPC 新的增长趋势,而联想在万全异构智算平台上的布局正是基于团队内部对于这一趋势的深刻洞察。

洞察算力新趋势,联想布局异构智算

当前,国内的算力集群已经有了不少千卡、万卡级别的实践,但要实现十万卡,甚至超万卡的突破仍旧有一定难度。

国产算力究竟有着怎样待解的难题?在黄山看来,主要有四个关键“卡脖子”的问题:

首先,多元异构处理器以及支持器、存储、网络等基础设施的硬件兼容性、互操作性设计是一项复杂的大工程;其次,AI训练集群故障频发是常态。一个千卡集群一个月至少有15次因故障停训,故障鉴别与恢复是AI训练算力达成SLA的关键难题。

再次,可用算力的效率还不够高,算力的投入产出不足以持续支持算力经济长期健康增长。最后,由于工艺限制难以突破的散热瓶颈。智算算力增长需要液冷工艺与方案设计的持续升级。

在今年的 CCF HPC 中,“超智融合”这一关键词被一众大咖反复提及,已然成为解决国内计算瓶颈的关键路径之一。这一趋势的出现,也标志着 HPC 由传统通用计算主导的科学计算,逐步过渡到了异构加速的 AI 计算新时代。

今年 4 月,联想正式发布的万全异构智算平台便是基于前述洞察做出的应对方案,是实现“算力好用”的破局关键。同时,也是联想“一横五纵”战略中的关键“一横”,此外,“五纵”则主要指支持器、存储、软件及超融合、信息网络以及边缘基础设施产物和方案。联想黄山:「超智融合」成算力新趋势,联想打造异构智算平台 

据联想方面介绍,万全异构智算平台集成了算力匹配魔方、GPU内核态虚拟化、联想集合通信运算规则库、AI高效断点续训工艺、AI与HPC异构集群超级调度器五大创新工艺,能高度自动化地完成AI全流程开发,提供高可用算力,并持续突破计算效率瓶颈。

会后,在接受 AI 科技评论专访时,黄山进一步介绍道,“我们的平台是一个异构智算调度软件,不同于普通或者说标准化的操作系统软件,或者虚拟化软件。这样的新赛道是由智算的增长催生的,目前赛道内还没有成熟标准,联想也没有一个有章可循的开发计划,主要是以客户的需求作为根本,最开始的开发就是有大项目在提出需求。”

在整个开发过程中,他体会最深的一点则在于,“在这个过程中,需求的变化非常之快,模型客户的应用变化也很快,软件栈的复杂度也非常高,又没有标准群,有可能上个月很好的开发和设计方式,下个月根据实际的场景又需要再进行优化。”

国产 GPU 算力将迎阶跃式提升

联想在破解算力难题,打造异构智算平台的过程中也遇到过许多难题,在此之中,生态的力量则成为了破局过程中不可或缺的存在,联想借此也将迎来新的进展。

今年 4 月,联想在信通院的领导下成立了万全异构智算平台生态产业联盟,据悉,异构智算产业生态联盟首批共计16家成员单位。其中包括了与联想有实际方案合作的 7 家国产 GPU 厂商。除此之外,还有包括Colossal-AI、智谱 AI 等在内的合作伙伴。

谈及与后者的合作,黄山进一步解释称,“我们向上看到 AI 的工具链并行运算规则,包括 AI 的开发社区都需要完善,整个的运算规则利用率是需要从芯片到模型层来解决的。”

联想在整个生态中主要扮演着怎样的角色呢?据黄山此前介绍,“联想主要贡献硬件能力和异构智算平台的集群运营调度能力。然后是对算力生态的包容,即硬件会兼容xPU生态硬件,异构智算平台会集成xPU底层软件。再就是以extended UI的方式对接集成AI工具链生态。”

值得一提的是,在黄山的预判中,国内 GPU 算力即将迎来一波阶跃式升级。

在和生态伙伴合作的过程中,他观察发现,“国内卡的生态已经非常丰富,在禁运后的一年多里,我们的合作伙伴中有至少 5 家到 7 家国产卡已经或是即将在半年内推出,这些卡组成万卡集群也是能支撑国内大模型持续增长的。”

他进一步向 AI 科技评论介绍道,“目前,7家芯片厂商在市场上各自有应用的对象,而且他们是互补的,很多都不冲突,要用好国产算力,其实 7 家都需要,甚至还有可能将来会涌现出更多,那么就需要先去把这些芯片做好运营和兼容,这一点是联想已经做到的。”雷峰网雷峰网(公众号:雷峰网)

雷峰网原创文章,未经授权禁止转载。详情见转载须知。

联想黄山:「超智融合」成算力新趋势,联想打造异构智算平台

- END -

2

黑客大会遇上元宇宙:极客精神的又一次狂欢

黑客大会遇上元宇宙:极客精神的又一次狂欢

1993年的拉斯维加斯,18岁的 Jeff Moss 正准备面临一场悲伤的别离。他的一位黑客朋友由于爸爸工作调动即将离开美国,为了给这份友谊再留下些纪念,Jeff 决定给朋友办一个盛大的告别 Part

当人形机器人开始走进车厂

当人形机器人开始走进车厂

作者丨赖文昕编辑丨陈彩娴8月21日,汇集了近170家国内外机器人企业的世界机器人大会WRC 2024)在北京如期而至。大会现场上,最受欢迎的主角们便是27款特点鲜明的人形机器人。回顾悄然过半的具身智能

英伟达梦想,富士康模式:Alexander Wang如何用24万数字游民打造数据标注王国

英伟达梦想,富士康模式:Alexander Wang如何用24万数字游民打造数据标注王国

这位世界上最年轻的白手起家的亿万富翁,曾在首次登上福布斯排行榜后迅速跌落,但几年后就重新夺回了这一头衔。给 Alexander Wang 带来这个极具传奇性的名号的,是他的数据工厂—— Scale A

AI 图像生成平台 LiblibAI 融资总额达数亿元;Meta 曝训练 Llama 3 每 3 小时「罢工」一次丨AI情报局

AI 图像生成平台 LiblibAI 融资总额达数亿元;Meta 曝训练 Llama 3 每 3 小时「罢工」一次丨AI情报局

今日融资快报AI 图像生成平台 Liblib AI 融资总额达数亿元 AI图像生成平台 LiblibAI哩布哩布AI一年内,已经完成了三轮融资,总金额达数亿元人民币,天使轮投资方为源码资本、高榕创投和

尹锡悦再被捕,或“牢底坐穿”

尹锡悦再被捕,或“牢底坐穿”

韩国首尔中央地方法院10日凌晨签发对前总统尹锡悦的逮捕令。负责调查紧急戒严事件的特检组随后实施逮捕。这是尹锡悦获释4个月后再次被捕。当地时间2025年7月9日,韩国首尔,韩国前总统尹锡悦中)抵达法院,

全球首发!无问芯穹发布千卡规模异构芯片混训平台,筑基面向MxN生态格局的AI Native基础设施

全球首发!无问芯穹发布千卡规模异构芯片混训平台,筑基面向MxN生态格局的AI Native基础设施

“打开水龙头前,我们不需要知道水是从哪条河里来的。同理,未来我们用各种AI应用时,也不会知道它调用了哪些基座模型,用到了哪种加速卡的算力——这就是最好的AI Native 基础设施。”7月4日,在20

AI 搜索向左,搜索 OG 向右

AI 搜索向左,搜索 OG 向右

作为 AI 世界的领头羊,OpenAI 发布的 SearchGPT 再次给 AI 搜索加了一把火。这把火原本由 Perplexity 引燃,在美国烧及 Google 和微软,在中国引发了百度、360

成立996天,MiniMax 每日与世界的30亿次交互

成立996天,MiniMax 每日与世界的30亿次交互

8月31日,“2024 MiniMax Link伙伴日”活动在上海正式举行。本次活动以Link连接)为主题,聚焦AI创新技术发展。活动现场,MiniMax创始人闫俊杰分享了基于MOE混合专家模型)+

欧洲理事会主席与伊朗总统通电话 讨论冲突解决方案

欧洲理事会主席与伊朗总统通电话 讨论冲突解决方案

△欧洲理事会主席科斯塔当地时间7月9日,欧洲理事会主席科斯塔与伊朗总统佩泽希齐扬举行电话会谈。科斯塔称,双方进行了深入交流并一致认为,通过对话解决冲突,是实现和平与稳定的正确途径。佩泽希齐扬表示,伊朗

英伟达梦想,富士康模式:Alexander Wang如何用24万数字游民打造数据标注王国

英伟达梦想,富士康模式:Alexander Wang如何用24万数字游民打造数据标注王国

这位世界上最年轻的白手起家的亿万富翁,曾在首次登上福布斯排行榜后迅速跌落,但几年后就重新夺回了这一头衔。给 Alexander Wang 带来这个极具传奇性的名号的,是他的数据工厂—— Scale A

2024WAIC热议大模型助力产业新趋势,可信应用成焦点

2024WAIC热议大模型助力产业新趋势,可信应用成焦点

作者:赖文昕编辑:陈彩娴2024 年已经过半,大模型技术的角逐也逐渐从上半场的「百模大战」转向下半场聚焦落地「千行百业」的产业应用。过去短短 2 个月以来,全球 AI 界接连开展了数十场发布会,从海外

Groq 获 6.4 亿美元融资;传 ResNet 作者张祥雨加盟阶跃星辰;OpenAI 研发 ChatGPT 文本水印丨AI情报局

Groq 获 6.4 亿美元融资;传 ResNet 作者张祥雨加盟阶跃星辰;OpenAI 研发 ChatGPT 文本水印丨AI情报局

今日融资快报人工智能芯片初创公司Groq获6.4亿美元融资,挑战英伟达Groq是一家开发芯片以比传统处理器更快地运行生成式 AI 模型的初创公司,该公司周一表示,已在由Blackrock领投的新一轮融