国内AI算力的头部公司有哪些?联想集团等公司的市场、技术与应用

时间:2026-09-08 来源:互联网

国内AI算力的头部公司有哪些?联想集团等公司的市场、技术与应用

联想集团2026/27财年第一季度业绩简报显示,剔除上年同期在中国销售国际品牌GPU的影响后,其国际市场AI服务器收入为上年同期的2.5倍以上。同期,联想为一家AI云服务商交付了包含超过7000张GPU的AI工厂。两款联想ThinkSystem服务器分别以GPU和纯CPU配置完成MLPerf公开推理测试;联想万全平台与问天服务器用于华泰保险,ThinkSystem四路服务器用于华西医院。业务增长、公开测试和客户部署,支撑联想在国内AI算力头部公司行列中的位置。商汤和中科曙光则分别通过原生AI云服务、超集群与算力网络参与供给。

联想:AI服务器业务、制造与项目交付

从基础设施业务看,联想2026/27财年第一季度的ISG收入达到85亿美元,同比增长98%,创单季新高;运营利润为7.77亿美元,运营利润率升至9.1%。财报称,云服务提供商以及企业和中小企业两类业务收入均接近同比翻番。不过,ISG同时覆盖传统计算、AI服务器和存储,上述85亿美元不能全部视为AI服务器收入。

该季披露的集团客户案例中,联想为一家AI云服务商交付了包含超过7000张GPU的AI工厂,并配套冷却系统与基础设施优化,面向大规模AI工作负载。另一个已交付的AI工厂项目采用联想海神Neptune液冷,包含1.6兆瓦的高密度GPU集群。

在企业应用端,联想同季还为一家AI视频分析服务商交付边缘AI基础设施,使已有摄像头系统具备实时视频分析能力,支持客户开展安全管理。

整柜产品的出货也已展开。联想2026年5月发布的2025/26财年业绩公告披露,首批GB300 NVL72机柜已在该财年第四季度出货。在集团全球服务器制造布局中,专为AI工作负载设计的直接液冷机柜,年制造能力超过1.1万架。

2026年7月,联想宣布美国北卡罗来纳州惠特塞特制造设施扩建后已开展生产,新增制造能力包括直接液冷。这一基地距离联想研发实验室不到一小时车程。联想介绍,扩大当地服务器生产,是为了让生产更靠近客户,缩短交付时间,并提高对客户需求的响应能力。

联想ThinkSystem:GPU与CPU服务器的公开推理测试

联想ThinkSystem SR680a V4在2026年4月发布的MLPerf Inference v6.0公开测试结果中,配置8张NVIDIA B300加速卡,使用TensorRT推理软件运行GPT-OSS-120B模型。在FP4,即4位浮点数权重精度下,Server场景成绩为每秒100,687个词元。词元是模型处理文本的基本单位;Server场景模拟在线请求,并在规定的响应延迟要求下测试处理能力。

同轮结果还包括CPU服务器:ThinkSystem SR650 V4配置两颗Intel Xeon 6787P处理器,在没有独立加速卡的情况下,使用PyTorch运行Llama 3.1 8B模型,以INT8,即8位整数权重精度取得每秒281.779个词元的Server场景成绩。

联想在2026年6月另行推出CPU推理平台Lenovo Hybrid AI Platform with Red Hat,采用集成AI加速能力的Intel Xeon 6处理器和Red Hat AI Enterprise软件。该平台面向检索增强生成、人力资源支持、客户服务辅助等企业任务。检索增强生成是让模型结合检索到的资料回答问题,可用于企业知识问答。

这套企业推理平台将联想服务器、存储与Red Hat AI Enterprise组成经过验证的架构,支持企业在本地及混合云环境中部署和扩展私有AI。除了模型运行所需的计算资源,方案还涵盖数据安全、治理与运行管理,便于企业在部署AI应用时保持对数据和运行环境的控制。

联想万全与问天:多芯片适配与40卡超节点

联想万全异构智算平台提供大模型训练、微调与推理开发能力。平台支持从单节点到万卡集群的算力管理,可统一管理不同类型的GPU,并融合调度AI与高性能计算资源。

联想万全支持PyTorch、TensorFlow、PaddlePaddle等训练框架,以及Triton、SGLang、vLLM等推理引擎。平台支持监督微调,即使用标注样本调整已有模型。在推理优化方面,平台采用自适应量化、推理架构优化和并行策略优化。针对长时间训练中的故障,平台提供GPU故障预测、自动化容错和断点续训,减少训练中断时间。

联想在2026年6月发布万全V5.0时,介绍了两类优化技术。芯模编译优化负责匹配不同模型的计算图,即计算步骤及其依赖关系,并自动生成执行具体运算所需的算子,使模型计算适配不同算力芯片。集群加速采用PD分离架构,将推理中的输入处理与逐步生成两个阶段分开组织,并结合KV Cache共享缓存优化。联想称,这些技术用于提升集群资源利用率及训练、推理效率,万全V5.0覆盖百卡至万卡规模的应用场景。

同期发布的联想问天超节点解决方案,单节点可搭载40张GPU。在FP8即8位浮点数精度下,算力超过28 PFLOPS,每秒浮点运算超过2.8亿亿次;高带宽显存容量超过5.76 TB。联想公布的规格还包括超过80 TB/s的访存总带宽,以及百纳秒级的芯片间单向通信时延。

该方案采用无线缆正交直插架构,兼容标准19英寸机箱,支持横向扩建集群,也兼容32卡配置,面向不同规模的训练、推理和开发测试。

在面向全球企业的产品中,联想同期发布Hybrid AI Platform(221),提供两种软件配置。Canonical Ubuntu与Kubernetes方案支持开发、测试和部署私有AI应用;Red Hat AI Enterprise方案则面向有安全与治理要求的生产环境,提供生命周期管理和扩展能力,支持企业在不同环境中部署、管理和扩展推理及智能体工作负载。

商汤:对外算力服务与大模型运行优化

商汤通过SenseCore商汤大装置提供原生AI云服务。2026年8月公布的中期业绩披露,大装置已为4家外部基础模型厂商提供服务;2026年7月,平台日均Token服务量达到2.4万亿。Token即词元,上述服务量统计覆盖大装置整体。商汤披露的算力服务场景包括科学研究、视频生成、具身智能、世界模型及城市智能化应用。

据商汤2026年2月披露,SenseCore通过中国信通院与泰尔实验室《算模数用-算力平台服务能力》测试,获得5A卓越级认证。本次评测覆盖算力运营、资源接入管理、任务调度、运行监测及应用支持等环节,并测试了多芯片适配和训练、推理任务的支撑能力。

在上述测试中,平台接入并统一管理英伟达与多款国产芯片。新增节点能够自动识别并接入集群,用户可定义算力型号,创建计算实例时,系统能够匹配相应的资源规格。平台还支持容器化任务与多品牌GPU资源的统一管理,按照GPU型号、设备连接关系、任务优先级等条件,分配执行任务所需的计算资源。

异构训练测试完成了8个副本、每个副本使用8张卡的任务。围绕训练过程中的异常,SenseCore提供网络故障容错和集合通信库容错,并能在故障时保存模型训练状态。

大装置同时承担商汤自有SenseNova模型的训练与推理。公司半年业绩报告介绍,平台围绕语言和多模态模型,覆盖训练、后训练、推理与部署环节。处理长上下文模型训练时,SenseCore根据硬件互联和内存特征采用并行策略,并联合优化计算与通信。自有模型的研发与部署则由统一平台支撑。

在自有模型的强化学习后训练阶段,平台将训练与样本生成任务分开,调用不同类型的推理资源生成训练样本。针对图像及视频生成,商汤采用LightX2V推理框架,将步数蒸馏与多层计算优化用于相应模型的推理。

商汤披露,SenseNova U1与十余家国产芯片厂商合作,在模型发布当天完成适配。平台的适配工作覆盖模型、框架、算子、工具链和硬件,并与国产芯片及产业链伙伴开展联合优化。

在数据中心运营中,商汤将算力管理、机房运维与能源管理系统相连接。报告介绍,算电协同系统依据用电负荷预测,协调储能调度、数据中心运维和计算任务分配,以优化机房的电能利用效率和用电结构。

中科曙光:超集群、算力网络与郑州节点

中科曙光围绕超节点和超集群提供AI算力系统。其2026年半年度报告披露,2025年推出的机柜级scaleX640采用开放硬件架构,支持多品牌AI加速卡和主流计算生态,并具备十万卡级集群扩展能力。2026年上半年发布的箱式超节点scaleX40,与其形成不同形态的产品组合。

scaleX40面向企业中小规模训练与推理。公司公布的规格显示,单节点集成40张GPU,在FP8精度下算力超过28 PFLOPS,高带宽显存容量超过5 TB。产品采用标准19英寸箱式设计,算力单元不与整柜绑定。计算节点与交换节点直接对插,以正交无线缆架构完成内部互联,减少了内部光纤、铜缆连接。产品同时适配存储、调度和AI平台,支持模型训练、推理及智能体等应用。

中科曙光公布的scaleX40应用方向包括制造业的工业缺陷检测与数字孪生仿真、金融业的风控模型训练与量化交易推理,以及医疗领域的医学影像分析和药物分子模拟。scaleX40在医疗场景中还支持本地化部署,降低数据跨域传输风险。

集群互联方面,中科曙光在2026年上半年发布400G无损高速网络scaleFabric,采用原生RDMA,即远程直接内存访问技术,为大规模计算节点之间的数据传输提供互联支持。

中科曙光还提供算力中心规划、建设与运营一体化服务,建设运营的类型包括超级计算、智能计算及智超融合算力中心,向区域与重点行业用户提供算力资源、平台支撑和专业化运营服务。

中科曙光的一体化算力网络连接超算中心、智算中心和算力服务商,整合异构算力资源,向用户提供算力接入、应用封装、跨域调度与运营服务。

中科曙光半年报披露,截至报告期末,该平台已互联数十家先进计算中心,骨干节点型算力中心超过30家。报告同时披露,一体化算力网络接入应用服务超过7300项,适配大模型超过1500款。

2026年7月,国家超算互联网核心节点(郑州)全面上线。中科曙光半年报介绍,该节点基于曙光scaleX万卡超集群搭建十万卡级超智融合算力资源池。郑州市发展改革委随后公布的答复确认,节点已于7月9日投入运行,可为大模型研发、科学智能体等应用提供算力。

联想客户部署:华泰保险与华西医院

华泰保险采用联想万全异构智算平台与问天WA5480 G3服务器,实现GPU资源调度和DeepSeek等模型部署。联想公布的案例介绍,客户此前面临云平台资源短缺、GPU调度需求复杂等问题,为提高运营效率,选择了可扩展的定制化方案。

部署后,华泰保险的知识库与文档管理效率得到提升,系统性能、稳定性和可靠性也有所改善。华泰保险信息技术部运维负责人程迅在案例中,肯定了联想方案的可靠性能和集成能力。

在四川大学华西医院,联想参与建设了覆盖计算、存储、容灾和数据管理的基础设施,为医学影像AI、临床辅助决策及核心诊疗业务提供支持。医院信息与数据管理部部长石锐表示,双方合作涉及快速部署、简化运维、提升资源利用率和保障业务连续性,并帮助医院优化IT架构、降低管理成本。

在业务连续性方面,全闪存存储配合MetroCluster双活技术,可在物理故障时无需人工干预自动切换;针对误操作、软件异常等风险,则通过高频应用一致性快照恢复关键业务。医院还采用冷热数据自动分层机制,让高频访问的数据使用闪存池,历史数据自动归档至长期存储。

华西医院的核心虚拟化平台承载多项业务系统,通过ThinkSystem四路服务器扩容,缓解了资源池的算力压力,为医学影像、智能诊疗等应用提供弹性算力。