超节点绕行英伟达:国产算力换了一条赛道
创始人
2026-08-17 02:01:18
0

文 | 互联网随笔

Kimi K3发布技术报告的时候,在官方部署文档里写了一句让整个算力圈没法淡定的话:推荐在64卡及以上超节点配置中部署。

这是超节点第一次被写进大模型的"安装说明书",而且是作为硬性门槛出现的——不是"最好有",是"没有不行"。Kimi K3有2.8万亿参数、896个专家,MoE架构下的通信量大到惊人,跨节点通信一旦卡壳,推理效率直接崩盘。你不用超节点,最新模型连该有的性能都跑不出来。

没过多久,阿里云真武M890超节点实例上线,Kimi K3和通义千问3.8 Max都开始在上面跑。供给端和需求端正在互相拉着往前走。

行业集体转向,很少是因为技术成熟了。大多数时候,是老路真走不下去了。

算力最值钱的东西不是芯片,是系统

SemiAnalysis估算过,单颗国产AI芯片的性能大概只有英伟达Blackwell的三分之一。先进制程被卡着,这道坎短期内谁也迈不过去。更麻烦的是,大模型的参数奔着数万亿去了,MoE架构下每蹦出一个词元,成千上万颗GPU就得来回同步参数、交换数据。

传统的8卡服务器,卡加得越多,通信等待时间越长,算力利用率反而往下掉。算力每两年翻三倍,内存带宽只涨1.6倍,互连带宽才涨1.4倍。芯片算得再快,数据供不上、传不动,全是白忙活。

超节点的做法很简单——用高速互联把成百上千颗芯片绑成一个逻辑统一的算力集群,让它们像住在一个屋里的邻居,数据不用再排着队过独木桥。华为内部算过,单颗昇腾确实不如英伟达,但昇腾950超节点的整体性能做到了GB200 NVL72的1.7倍。

翻译一下就是:你单卡强,我认。但我不跟你比单卡了,换个战场重新定规矩。

英伟达真正的护城河是CUDA生态——十几年积累,几百万开发者,你在单卡上跟它打,等于在人家的主场踢球。但超节点拼的是集群调度、互联效率、系统稳定性,是上万颗芯片连着跑十天半个月不出岔子的工程本事。这套系统工程能力,英伟达并没有几十年的先发优势,大家的起跑线没差那么远。超节点相当于绕开了英伟达守了几十年的正门,从侧面撕开了一个口子。

三条路线,谁能跑出来?

今年WAIC,各家把超节点方案都摆到了展台最前面,路子却完全不同。

第一条路:往大了干,靠规模碾压。华为昇腾950超节点做了1024卡,满配能顶到8192卡,目前业内最大。中科曙光更狠,十万卡集群曙光8000直接落地郑州国家超算互联网核心节点,上线就满载。这个量级的集群考验的不是堆卡能力,是系统架构、网络互连、访存效率、能效控制——每一项都是在挑战工程极限。

曙光8000有个设计很有意思,叫"原生超智融合"——同一套系统从FP64科学计算精度到INT8推理精度全都能跑,一套底座既能训大模型,也能做气象预报、基因测序。

中科曙光高级副总裁李斌原话挺实在:从万卡到十万卡,乘以10这件事本身不难,难的是乘完10之后,性能还能不能跟着乘10。规模大了之后最大的难点在于能否跑出应有的性能和效率,任何一个环节的短板都会导致性能折损。

第二条路:往底层钻,换传输介质。如果说华为和中科曙光是在"做大",壁仞是在"做透"——从传输介质这个根上重新写规则。

壁仞搞了个NPO光互连方案,用光信号代替铜线,单个超节点能扩展到1024卡。铜缆电信号超过3米就开始严重衰减,现有方案顶多支持128张GPU,英伟达也在撞这堵墙——2026年GTC上黄仁勋亲口说要用光互连把系统从NVL72拉到NVL576。壁仞不光是换线,还把GPU节点和交换机节点物理分开,用光纤灵活互连,彻底甩掉了大铁盒子形态。

第三条路:往便宜了做,把门槛降下来。 中兴OEX走开放解耦,兼容好几家芯片,客户自己搭配。中科曙光在这个方向上也下了注——scaleX40,全球首个无线缆箱式超节点,40卡的标准19英寸箱式设计,部署从小时级压缩到分钟级,现有机房直接塞进去就能用。

不是谁都要十万卡的,40卡才是大多数企业用得起的量——40卡正好落在性能与成本的平衡点上。中科曙光两条腿走路:往上顶到十万卡的天花板,往下把门槛降到中小企业够得着。这种"两头押注"的打法,在这一轮超节点竞赛里并不多见。

英伟达先做芯片,国产先做超节点

回头看英伟达的走法:先迭代GPU架构,再升级NVLink互联,最后用NVL72的形态把芯片和互联打包成完整超节点。国产算力产业走了条完全相反的路——先把超节点这个系统级方案做出来,再去倒逼每颗芯片的设计。制程追不上就不追了,在系统层面重新定规矩。

一旦系统级效率成了新标准,单卡性能差距就没那么要命了。你不用在别人家门口踢一场必输的球——你自己画了块场地,按自己的规则踢。

这事最值得琢磨的地方在于:英伟达被挑战,从来不是因为有人在单卡上超过了它。AMD没有,英特尔也没有。真正让英伟达紧张的,是有人在系统层面重新定义了算力供给的方式。

国产算力产业赌的就是这件事——不跟你打你擅长的仗,在你还没建立起绝对优势的领域抢先布子。

相关内容

热门资讯

科技趋势2026:AI与量子计... 近些年来, 科学技术的发展呈现出一日千里的状态, 重中之重的是人工智能以及量子计算这两大范畴, 正在...
伊朗称美军已被驱逐不得进入海峡 8月16日,伊朗陆军总司令哈塔米今天(8月16日)表示,美军已被驱逐,不再获准进入波斯湾、阿曼湾及霍...
原创 为... 为何会有市民打12345投诉月光太亮影响睡觉? 碧翰烽/文 据媒体报道,近日,一则爆料引发热议:有...
【2026年】高校科研实验室通... 一、高校实验室通气项目为什么容易"翻车" 高校科研实验室通风系统建设,常被戏称为"立项轰轰烈烈、验收...
“如是书院”违法经营已被关停,... 8月16日,有媒体于8月5日报道浙江新昌县“如是书院”相关问题。当日当地成立联合调查组,开展线索核查...
“正名”之后 青海拉面如何走出... “出门饺子回家面”,很多人说,一碗面里装着的,是中国人的乡愁。按照这句话,遍布全国的“兰州拉面”,应...
泰莱德自动化取得变频器故障检测... 国家知识产权局信息显示,安徽泰莱德自动化技术有限公司取得一项名为“一种变频器故障检测装置”的专利,授...
特定时空环境下负有救助义务的人... 我在国内各地有10000多律师好友,如果你要寻找外地律师合作,请加我微信(hzm5349),我帮你推...
全国唯一具身智能人才考试认证中... 8月16日,杭州具身智能人才培养与考试认证中心及宇树科技机器人(具身智能)职业技能培训中心正式亮相,...
中信建投:当前算力产业链需求仍... 8月16日,中信建投证券研报指出,7月底全球科技去杠杆基本结束,海外科技在宏观约束缓解和产业景气验证...