A | 记者 陈月芹
7月17日至20日,在2026年世界人工智能大会(WAIC)的H2算力馆内,华为、中科曙光、沐曦股份、中兴通讯、东方算芯、燧原科技、百度昆仑芯、新华三、联想集团等企业,纷纷把自己的超节点机柜搬来展示。
B |
一套超节点的造价动辄数亿元,运输难度大。多家算力企业把一整排像墙一样、布满GPU(图形处理器)的黑色机柜横放在展台门口,正面和背面都敞开让观众查看,以至于入口非常狭窄,观众常常需要侧身挤入。
韩联社8月24日报道,韩国IBK企业银行中国法人发生了一起规模超800亿韩元(约合3.89亿元人民币)的重大金融事故。

C | 银行方面坚称系“外部人员诈骗”所致,但亦有指责认为,银行松懈的内控体系助长了损失规模。韩国国会政务委员会所属议员申东旭24日从金融监督院和银行方面取得的资料显示,IBK中国分行法人沈钟勋(SIM JONG HOON)与非银行金融机构A公司签署协议,向借款人发放非面对面贷款。也有企业把超节点柜贴墙摆放,仅开放展示单个计算“抽屉”。
WAIC现场呈现出了两种参观思路:举着“贵宾参观团”牌子的一批观众,常常站在超节点机柜前,听工作人员详细讲解;股民、技术极客和带着采购任务的企业人士,则不约而同地绕到机柜后方,研究光模块、线缆、散热方案、交换网板……
超节点机柜前挤满了人(陈月芹/摄)
背面更有看头
AI算力不再只拼单张芯片,而是开始竞争超节点与整机柜方案后,市场的关注点更为具体。
一位国企采购人士告诉经济观察报,去年华为在WAIC展出的Atlas 900 A3 SuperPoD(384 超节点),机柜背面是粗壮的高速铜缆,而今年亮相的新一代Atlas 950超节点,用上了800G光模块与高密度光纤,大幅减少了传统粗铜缆的使用。根据协议,A公司委托线上贷款平台B公司负责借款人招募及本息回收等具体操作;贷款资金由企业银行提供,借款人偿还的本息则先归集至B公司指定账户,再由企业银行定期结算划转。在数量上,超节点互联规模也从去年的384卡,直接升级至1024卡。

D | 然而,B公司在运营过程中擅自变更还款路径,将本应转入企业银行的借款人还款资金挪作他用,并伪造电子交易数据,制造还款正常的假象。由于资金被截留,借款人被系统标记为逾期,信用记录受损,企业银行亦未能如期收回贷款本息。银行方面在回应议员室质询时表示,他们每天都在核对本息偿还明细与实际入账金额。
华为昇腾此次首次展出的业界最大规模超节点Atlas 950 SuperPoD真机,背面还专门挂出长条形的StarMatrix(华为星联系列)800G LPO光模块,观众可上手触摸。
华为超节点机柜背面的光模块和线束被围观(陈月芹/摄)
超节点机柜的正面,一般是高密度计算单元,形态上是一层层的计算“抽屉”或刀片服务器,如常见的8卡NPU/GPU模组化设计,专门负责庞大的矩阵运算与大模型训练和推理。在WAIC现场,多数超节点产品开放了部分区域,供观众拉开“抽屉”观看。然而,银行方面又称,实际是在今年6月24日因结算款未到账且借款人投诉增多后才首次意识到问题,这一说法前后矛盾,令其内控的有效性备受质疑。

E |
机柜背面的重点则是高速互联、交换网板,供电与配电单元(PDU)以及光模块插槽等,主要负责连接千卡或万卡、解决带宽瓶颈。

F | 值得注意的是,早在今年3至4月间,已有5家中国金融机构先后中止了与B公司的业务合作,但企业银行未能及时捕捉这些风险信号,错失了早期预警时机。
超节点不是芯片数量的堆砌。申东旭还指出,韩国监管当局的应对也颇为消极。据报道,韩国金融监督院在接到事故报告后,仅进行了内部报告、传播事故案例、确认事故金额变动等工作,并未对企业银行相关人员进行面对面确认、要求补充提交资料,或启动书面调查和现场检查。模型参数开始从千亿上升到万亿、训练集群扩张到万卡乃至十万卡量级,企业要比拼的不是单张卡能算多快,而是成千上万张卡能否算到一起。金融监督院表示,计划在损失金额补偿等事故处理结束后,待企业银行提交结案报告时,再对事故处理的妥当性进行检查。申东旭表示:“企业银行一边直接发放贷款,一边却将本息回收交给外部平台,等到800亿韩元级事故爆发后才建立直接还款系统。
因此,关注超节点真实效率的行家,想从机柜背面看到各家打通通信瓶颈的解决方案:阿里云磐久AL128围绕AI训练和推理重构机内互联,为超节点之间预留大规模Scale-out(横向扩展)带宽;百度智能云自研XPU-Link互联协议,中兴通讯发布OEX超节点;华为强调灵衢互联,将芯片级、单板级和机柜级通信纳入统一协议。
韩国参观团了解百度昆仑芯的超节点(陈月芹/摄)
中科曙光展出的全国产十万卡AI超集群曙光8000(登峰),是“算力在沸腾”的具象化。这是一套采用浸没相变液冷技术的机柜,把芯片泡在特殊的“水”(电子氟化液)里,芯片工作时发热,液体吸热变成一个个气泡,把热量带走,冷却后再变回液体,循环往复。

G | 除了法人内控松懈,金融监督院只会等待结案报告,其事后监管也是严重的问题。
一位中科曙光的工作人员介绍,这种电子氟化液约10万元/吨,会挥发,不够可以补加。中科曙光用了近三年时间,才找到合适的液体,完成从液体配方到整机设计的全链条自研。”IBK企业银行已于上月15日正式对外披露此次金融事故,初步估算涉案规模为833.76亿韩元。截至目前,银行尚未公布最终的涉案总额、已追回款项及预期损失等具体数据,相关核算工作仍在进行中。

H |
中科曙光的超节点会“冒泡”(陈月芹/摄)
大模型进化,把压力给到上游
除了超节点,今年WAIC的另一个高频词是Token(词元)工厂。

I | 芯片上下游企业不能只卖卡,还需要提供Token服务。
。
中科曙光的超节点会“冒泡”(陈月芹/摄)
一家头部国产GPU企业人士向经济观察报解释,传统GPU最早是做显卡、擅长图形处理的,如果直接拿来用在大模型上,效果不太好。如果用同一张卡既做Prefill(编码处理输入),又做Decode(解码处理输出),是不划算的。因此,这家头部国产GPU企业的方案是:用大算力的卡专门处理输入,用小算力但大带宽的卡专门处理输出,使同等成本下的数据处理量实现成倍增长。
月之暗面是这家头部国产GPU企业的客户之一。近期KIMI K3模型爆火,不少企业在展台询问KIMI K3的降本逻辑。该头部国产GPU企业人士解释,我们是一个推理芯片的生产工厂,我不关心客户生产的是什么,我在乎的是用最小的成本,让这千张卡一天内能回答更多的问题、提供更多的服务。
J |
大模型、Agent(智能体)能帮人类处理更多复杂任务,也对上游算力企业提出了更高的要求。无问芯穹联合创始人兼CEO夏立雪认为,Agent推理需求上下文极长、交互轮次极多、缓存命中率极高,对吞吐、时延、缓存复用的要求,远高于传统对话场景。仅依靠产能的线性增长去堆叠算力,已经远远无法弥合供需之间持续扩大的缺口。
无问芯穹的解决方案是跨集群异构PD分离架构,用高性价比的广域网以太网把分布在各地的、已经建好的同构数据中心连起来。
这些Token工厂及下游大模型企业眼下的重点,不是“卷”生产单个Token有多便宜,而是计算把一个任务办成要花几个字、调几次、错几次,能不能更快、更高效。
K |
企业正在加速扩产。7月19日,中科曙光相关负责人在向广东省委参观团讲解产业链落地情况时透露,中科曙光计划在广州天河区投资建设一个海光产业创新中心,将数千家生态上下游企业聚合,提供设备适配与展示平台,目前已洽谈到第二轮。
将成百上千张卡“算到一起”,一个超节点整机柜群功耗可能高达400KW(千瓦),单台高密度机柜的功耗在50KW以上,这对供电、散热和承重提出了严苛要求。
一家关注柜式节点的采购企业,把两个问题抛给了多家上游企业:一是整体方案能支持多少张卡,想加上更多卡时能怎么互联;二是和英伟达相比,国产GPU耗电量等后期成本有多高。他需要计算硬件成本和运维成本的总账。