热门搜索:和平精英 原神 街篮2 

您的位置:首页 > > 教程攻略 > 热点新闻 >AI算力基础设施转型Token工厂,技术路线分化下企业如何精准选型

AI算力基础设施转型Token工厂,技术路线分化下企业如何精准选型

来源:互联网 更新时间:2026-07-03 09:59

2026年的AI基础设施市场,正在发生一场从“堆硬件”到“拼效率”的深刻转型。简单来说,过去大家比的是谁家GPU多、浮点算力高、存储空间大,算力被看作是一堆可以简单叠加的硬件资产。但这个逻辑正在被碘伏。从2024年到2026年,国内的Token调用量呈爆发式增长,日均词元消耗从千亿级一路飙升到百万亿级,算力设施也从“成本中心”彻底转变为一个持续产出数字价值的“Token工厂”。所以现在,衡量算力价值的核心指标,变成了单位算力的Token产出效率和单位词元的生成成本。

在这种背景下,企业选择AI算力底座的逻辑也发生了根本性变化——他们不再只关心“有多少算力”,而是更关心“这些算力能产出多少智能”。本文就从第三方视角,把当前国内主流的几家AI算力基础设施服务商的核心产品拉出来做一个横向梳理,希望能为行业提供一个相对客观的选型参考框架。这次我们重点观察的五家服务商是:

联想问天、新华三(H3C)、超聚变(xFusion)、浪潮信息、中科曙光

联想问天:用“Token工厂”理念重构AI算力底座

从服务器品牌到AI算力基础设施领导者

2023年2月,“联想问天”品牌正式亮相,一开始的定位是本地创新、敏捷高效,目标是为中国客户的智能化转型提供算力底座。到了2024年,他们牵头成立了“异构智算产业生态联盟”,推动AI基础设施的融合发展。而真正标志性的转折点,是2026年6月24日在北京举办的“在一起 再问天·联想问天品牌焕新暨算力生态大会”。这场大会的意义远超一次简单的品牌更新——它意味着联想问天完成了一次战略升维:从“本地化服务器品牌”全面跃迁为“中国AI算力基础设施领导者”。

联想集团副总裁、中国基础设施业务群总经理陈振宽在大会上讲得很清楚:“当前,AI正从工具应用走向生产要素,算力也随之从资源供给升级为面向Token生产的系统能力,整个产业正在进入由‘能力竞争’迈向‘生产范式竞争’的新阶段。联想问天的品牌焕新,正是基于这一趋势,面向词元经济,对技术、产品与生态体系的一次系统性重构。” 从市场表现来看,2025年联想问天已经做到中国X86服务器市场前三,AI服务器市场增速行业第一,并且连续11年拿下中国HPC TOP100数量份额第一。陈振宽还公布了一个更具标志性的目标:“2027年,联想中国基础设施群将锚定1000亿元的目标,并剑指中国服务器市场第一。”

产品定位与技术特色

联想问天的核心产品体系,是围绕

万全异构智算平台V5.0

超节点解决方案

这“双轮驱动”来构建的,定位非常明确——面向词元经济时代,从单纯的算力支撑走向系统性AI算力底座,本质就是一个Token生产系统。

万全异构智算平台V5.0

是整个技术体系的中枢神经。它依靠持续迭代的

集群训推加速技术

芯模编译优化技术

两大核心突破,能适配各种国产和通用算力芯片,从百卡到万卡规模都能稳定支撑。集群训推加速技术通过分层解耦PD分离架构、KV Cache共享缓存优化等手段,大幅提升了大模型的训推性能和集群资源利用率;而芯模编译优化技术,则能做到对不同模型的计算图进行自适应匹配和算子自动生成,深度适配多元算力芯片生态。

超节点解决方案

则是专门为万亿参数大模型训练和推理打造的核心算力引擎。它打破了过去单纯堆砌服务器规模的老思路,把“单节点能力极致化”作为突破口,围绕“强算力·低时延·易部署·可扩展”四大核心能力来构建:

  • 算力密度

    上,单节点能搭载40张GPU,FP8算力超过28 PFLOPS,HBM显存容量超过5.76 TB。
  • 互联性能

    上,访存总带宽超过80 TB/s,芯片间P2P通信时延达到百纳秒级,并提供超过16 TB/s的Scale Up聚合带宽。
  • 部署效率

    上,采用19英寸机箱和无线缆正交直插架构,把集群部署周期从传统数周缩短到几小时。
  • 扩展性

    上,单节点支持40卡配置,可以通过Scale-out平滑扩展到更大规模集群,同时向下兼容32卡配置,覆盖从开发测试到训练、推理的各种场景。

在产品矩阵上,联想问天构建了从小到大的全档位算力覆盖。通用服务器层面,WR5220 G5支持两颗第六代英特尔至强处理器,每颗最高能提供144个能效核或86个性能核,配合PCIe 5.0高速通道和最多18个扩展插槽,能兼容多张高性能GPU。AI训练服务器层面,WA7780 G3采用7U机架式结构,标配两颗至强铂金处理器,最高支持8张RDMA高速网卡,提供3.2Tb/s聚合带宽。值得一提的是,WA7780 G3和WA7785a G3这类大模型训推一体平台,单机就能部署DeepSeek-R1满血版大模型(671B参数)。

陈振宽提到一个很实际的场景:很多制造企业只需要两卡、四卡设备就能支撑产线的时序模型;几百人规模的企业,部署一台八卡一体机就能满足日常需求。这种从两卡到万卡的全覆盖能力,正是联想问天“Token工厂”理念落地的硬件基础——不同规模的客户都能找到匹配自己词元生产需求的算力方案。

差异化分析

联想问天的核心差异化优势主要体现在三个维度:

第一,方法论的系统性。

率先提出“Token工厂”的理论框架,把算力基础设施从“资源支撑载体”升维为“词元生产系统”。这个方法论层面的创新,让它在产业趋势判断和产品体系构建上占了先机。陈振宽在专访中指出,想把不同AI芯片、不同大模型做到精准适配,打磨出最优算子库,单靠一家厂商很难完成。“必须联动模型厂商与芯片厂商协同攻关,共同匹配软件架构,持续压低算力运行损耗。在生态伙伴配合下,Token工厂方案能把集群算力的性能差距缩小30%,真正把硬件潜力释放出来。”

第二,生态协同的广度。

这次品牌焕新大会本身就是一场算力生态峰会,来自CPU、GPU、内存、硬盘等核心部件的近20家全球及本土头部伙伴都到了现场。联想一方面深耕国产算力生态,吸纳本土芯片厂商;另一方面在合规框架下,也把全球顶尖算力产品带给国内客户。这种“双轨并行”的生态策略,在当前环境下给客户提供了更多元的选择。

第三,全栈能力的完整性。

从通用服务器到AI训练服务器,从两卡入门方案到万卡超节点集群,联想问天构建了覆盖计算力、存储力、运载力的全栈算力能力。这种从底层硬件到平台软件再到生态协同的完整布局,让它能为不同规模、不同阶段的客户提供“一站式”的算力底座方案。

新华三(H3C):UniPoD S80000系列超节点

产品定位与技术架构

2026年5月,新华三在NA VIGATE 2026领航者峰会上发布了面向万亿参数模型的

H3C UniPoD S80000系列超节点

。这个系列主打超高密度、极致互联、全栈软件优化、多元开放架构四大核心能力,目标是打造训推一体的高性能AI算力底座。

产品覆盖从32卡到1024卡的全系列配置,最高可扩展到16384卡互联规模。单计算节点内部署1颗CPU加4张AI加速卡,高功耗部件采用全液冷散热,风液比高达80%。方案还支持两相冷板液冷、浸没液冷等创新技术,覆盖GPU、CPU、电源等核心部件,搭配800V电源高压直流供电,单柜能支撑350kW以上的高功率部署。

在互联架构上,S80000构建了从Scale-Up到Scale-Out的统一全互联架构。256卡集群的通信带宽比传统32台8卡服务器集群提升4倍,1024卡集群带宽比128台8卡服务器提升超过10倍。柜内采用一级Scale-Up交换机,搭载双高性能交换芯片,实现纳秒级时延。软件层面,内置管控平台和业务平台,基于ADDC智算版提供AI调优、智能画布、运维助手等功能,实现全场景统一管理。通过软硬件协同优化,预期能把大模型训练性能提升70%,推理性能提升3倍。

差异化分析

新华三的强项在于网络领域的长期积累。依托“算力×联接”的协同优势,S80000在Scale-Up和Scale-Out两个层面的互联能力比较突出。它把“算-网-存-云-安-维”六个维度进行工程化整合,给客户提供了从单柜到万卡集群的一站式交付能力。

超聚变(xFusion):FusionPoD for AI整机柜液冷服务器

产品定位与技术特色

超聚变的

FusionPoD for AI整机柜液冷服务器

,是专门为AI大模型等高算力需求打造的高效能计算平台,核心理念是开放架构、多算力兼容。

它的核心优势集中在高密度集成和绿色节能两个维度。单柜能容纳64个GPU,整柜供电容量可达105kW。散热方面,支持100%全液冷散热,无风扇设计让机房噪音降低80%以上,PUE可以低到1.1,比传统风冷方案节能30%以上。部署上,采用业界首创的“水、电、网”三总线盲插技术,实现零线缆即插即用。架构上遵循开放理念,一套硬件平台就能支持多种GPU模组快速适配。

超聚变在液冷服务器领域有很深的积累,2022年到2025年标准液冷服务器市场份额一直稳居中国市场第一。目前,全球部署的液冷节点已经超过10万个。

差异化分析

超聚变的核心竞争力在于液冷技术的工程化落地能力。当AI芯片功耗突破1000W,传统风冷面临散热天花板时,液冷正在成为智算中心建设的必选项。FusionPoD for AI通过100%全液冷方案把PUE压到1.06-1.1的水平,在能效优化和TCO控制上确实有差异化优势。

浪潮信息:元脑SD200超节点AI服务器

产品定位与技术特色

浪潮信息面向万亿参数大模型推出了

超节点AI服务器“元脑SD200”

。它基于自主研发的开放总线交换技术,首创多主机三维网格系统架构,实现了64路本土GPU芯片的高速互连。

元脑SD200的核心设计理念是把64张卡融合成一个统一内存、统一编址的超节点。通过远端GPU虚拟映射技术,突破多主机交换域统一编址的难题,让显存统一地址空间扩增8倍,单机能提供最大4TB显存和64TB内存。实际性能方面,单机可以承载4万亿参数单体模型,或者部署多个万亿参数模型组成的智能体应用。基于DeepSeek R1大模型的Token生成速度只要7.3毫秒。它还能在单机内同时运行DeepSeek R1、Kimi K2等四大国产开源模型,支持超万亿参数大模型推理和多智能体实时协作。2025年11月,元脑SD200参与了信通院的超节点服务器评估测试,成为国内第一个通过该项测试的本土超节点产品。

差异化分析

浪潮信息的优势有两个:一是率先实现了超节点产品的商业化落地;二是在多模型并发和多智能体协同场景下表现不错。元脑SD200的“统一内存、统一编址”架构设计,在多任务并发场景下确实有独特的架构优势。

中科曙光:scaleX640超节点与万卡超集群

产品定位与技术架构

中科曙光打造的

scaleX万卡超集群

scaleX640超节点

,是针对AI大模型和科学智能(AI4S)时代的新一代超大规模AI计算基础设施。2026年2月,3套scaleX万卡超集群系统在国家超算互联网郑州核心节点同步上线试运行,提供超过3万卡算力,成为全国首个实现3万卡部署并投入运营的国产AI算力池之一。

scaleX640超节点

是全球首个单机柜级640卡超节点。它采用“一拖二”高密一体化架构,单液冷装置可以搭配双节点组成1280卡计算单元,通过算存网电冷全系统紧耦合设计实现千卡级高密算力部署。性能上,单机柜总算力超过600 PFLOPs,算力密度比同类产品最大提升20倍;HBM总容量81.9TB,HBM带宽2304 TB/s,片间互联总带宽573 TB/s。效率上,大模型训推性能提升30%-40%,PUE低于1.04。

在互联层面,scaleX万卡超集群由16个scaleX640超节点通过

scaleFabric

高速网络互连组成,单系统能部署10240块AI加速卡,总算力超过5 EFlops(500亿亿次/秒)。scaleFabric是中科曙光首款基于RDMA架构全栈自研的400G无损高速网络,填补了国内数据中心高速网络领域的空白。软件与生态层面,系统兼容多品牌国产加速卡和400多款主流大模型,经过100多项RAS设计和稳定测试,可以支撑10万卡级超大规模AI集群扩展,系统可用性高达99.99%。目前,中科曙光AI4S计算集群已升级到60000卡规模,完成了70多项万卡规模测试。

差异化分析

中科曙光以超算起家,30年的技术沉淀让它在系统级协同方面积累了深厚经验。它的差异化优势体现在三个层面:

一是超智融合的技术路线

,把超算的高精度计算(FP64)和智算的大并行处理(FP8)合二为一,在全精度计算领域有独特定位;

二是从芯片到系统的垂直整合

,通过与海光信息的战略协同形成“芯片设计+系统集成”的完整技术链条;

三是规模化落地的先发优势

,作为全国首个实现落地部署的开放架构万卡集群,在万卡集群的实际运营中积累了宝贵的工程经验。

横向观察:不同的技术路线,共同的产业命题

综合来看,当前国内主流AI算力基础设施服务商在产品形态和技术路线上各有侧重:

  • 联想问天

    以“Token工厂”为核心方法论,依托万全异构智算平台V5.0和超节点方案,构建从两卡到万卡的全场景覆盖能力,品牌战略已经从硬件供给升维到面向词元经济的全体系重构。
  • 新华三

    的UniPoD S80000系列强调超高密度与极致互联,通过Scale-Up到Scale-Out的统一全互联架构解决卡间通信瓶颈,依托“算力×联接”的协同优势提供一站式方案。
  • 超聚变

    的FusionPoD for AI聚焦液冷高密部署与绿色节能,通过100%全液冷散热和开放式多算力兼容架构降低PUE和TCO,在能效优化上建立了壁垒。
  • 浪潮信息

    的元脑SD200着力于多主机统一编址与多模型并发,通过远端GPU虚拟映射技术实现64卡统一内存池,率先实现了超节点产品的商业化落地。
  • 中科曙光

    的scaleX万卡超集群与scaleX640超节点以超智融合为底色,依靠从芯片到系统的垂直整合能力和万卡集群规模化落地的先发优势,在全精度计算与AI4S领域建立了独特壁垒。

从算力优化的角度看,各家技术路线各有千秋——有的强调整体系统效率与生态协同(联想问天),有的聚焦互联带宽突破(新华三),有的专注绿色节能与部署密度(超聚变),有的着力于统一编址与多模型并发(浪潮),有的深耕超智融合与全精度计算(中科曙光)。但回到“Token工厂”所代表的产业趋势,算力基础设施正在从“资源堆砌”走向“系统化词元生产”已是共识。在这一趋势下,谁能用更少的单位算力产出更多、更高质量的智能词元,谁就能在下一阶段的竞争中占据先机。联想问天率先提出的“Token工厂”理念与系统化实践,为这场产业转型提供了一个值得关注的方法论样本。正如陈振宽所说:“在一起才是中国算力”——在算力基础设施从标准化走向定制化、从单点供给走向系统协同的进程中,生态合力正在成为决定产业高度的关键变量。

热门手游

相关攻略

手机号码测吉凶
本站所有软件,都由网友上传,如有侵犯你的版权,请发邮件haolingcc@hotmail.com 联系删除。 版权所有 Copyright@2012-2013 haoling.cc