“客户对智能云算力的需求已产生根本性改变——从曩昔遍及选用单机8卡服务器独立运转单一运用,转向对百卡、千卡甚至万卡级大规划集群化算力的火急需求”。在2026年世界智能云混合云部总经理杜海承受《世界金融报》等媒体采访时指出,超大规划超节点已成为算力职业确定性的干流开展方向。
当时职业干流计划会集在16至128卡区间,罢了首先落地256卡超节点,并计划于下一年年头推出512卡、1024卡规范的更大产品。杜海表明,集群规划是硬件计划选型的中心依据,存在明晰的分界:128卡及以下的中小型集群,优先选用纯电互联计划,本钱更低、布置灵敏;256卡以上的超大集群,则选用光电交融组网,底层电互联、上层光互联,以提高通讯密度。
杜海估计,长时间来看光互联与电互联不或许会呈现单一技能筛选另一方的局势,而是依据集群规划与布置本钱混合调配运用。在散热层面,液冷是大规划集群的长时间方向,一起兼容风冷机房的混合改造计划,是现阶段客户落地的最优挑选。
WAIC 2026首日,智能云已对外展现国产超节点“天池”的自研打破,并发布昆仑芯万卡集群、吉瓦级AIDC建造等多项AI Infra开展。据杜海介绍,天池256超节点从底层XPU-Link互联协议、交流与整机架构,到液冷CDU散热均为百度自研,完成了国产算力从“单点可用”走向“体系级、规划化可用”的完好闭环。
他进一步泄漏,天池超节点从点亮到上市首要霸占了三类工程难题:一是高速互联在规划、本钱和密度上的平衡,经过自研互联技能和架构规划,将互联本钱与单柜互联网空间均节约50%;二是大规划下的功率和安稳才能,经过自研拥塞操控算法、报文分类与QoS机制、链路高可用算法,有用应对“多打一”流量抵触及毛病爆破半径扩展问题;三是供电和机柜结构,选用双Power Shelf计划使单柜支撑66kW高功率,并在规范机柜尺度内合理规划承重与布线,统筹运维便当与功能密度。
杜海表明,未来天池超节点下一代512/1024卡版别,不只将支撑单超节点支撑万亿参数模型练习,还将根据昆仑芯M系列推出千卡、四千卡超节点,进一步拓宽国产算力的规划化鸿沟。
针对职业算力竞赛焦点的改变,杜海给出了明晰判别。曩昔职业比拼GPU卡的TFLOPS峰值算力,现在算力瓶颈早已不限于芯片供应严重,土地规划、能耗目标、电力供应全链条均存在束缚。一套完好的AI算力服务,从IDC机房选址建造、供电动力计划、芯片选型、大规划集群调度,到模型练习推理功率与智能体落地作用,每一环都影响算力转化功率。职业不再只看芯片峰值算力数值,转而衡量每瓦算力功能(FLOPS/W),寻求算力、、能耗目标的全链路协同优化。
他进一步剖析,当下千卡、万卡甚至十万卡级超大规划智算集群成为干流,机房土地、绿电供应、能耗批阅目标全面趋紧。一起,算力需求会集在人口密布的滨海城市,而风电、光伏等低本钱绿电首要散布于西部,空间错配问题杰出。百度的应对战略是在动力充分区域提早布局智算中心,经过跨区域调度算力与资源,匹配市场需求。杜海总结:“职业一致是,开展AI算力,芯片、电力、能耗目标三者缺一不可。”
值得一提的是,关于本年职业遍及将Token耗费量作为衡量AI开展的中心目标,杜海在受访中提出不同观点。他以为,单纯Token耗费量仅仅进程目标,无法衡量大模型及AI基础设施的实在工业价值,很多Token耗费也或许意味着使命履行功率低下,更应该重视智能体的落地和产出。